惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

GbyAI
GbyAI
The GitHub Blog
The GitHub Blog
小众软件
小众软件
美团技术团队
博客园 - 司徒正美
G
Google Developers Blog
Blog — PlanetScale
Blog — PlanetScale
Hugging Face - Blog
Hugging Face - Blog
博客园_首页
大猫的无限游戏
大猫的无限游戏
罗磊的独立博客
Recent Announcements
Recent Announcements
酷 壳 – CoolShell
酷 壳 – CoolShell
D
Docker
J
Java Code Geeks
Last Week in AI
Last Week in AI
V
Visual Studio Blog
Microsoft Azure Blog
Microsoft Azure Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
V
V2EX
C
Check Point Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
MyScale Blog
MyScale Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
AI助力打造真人及3D场景的高效流程
58UXD · 2025-07-31 · via 人人都是产品经理

在数字创作领域,AI技术正以前所未有的速度重构内容生产的逻辑,尤其是“真人及3D场景”的打造,更是打破了虚拟与现实的边界。从影视级虚拟场景到个性化数字人,从游戏角色定制到商业广告合成,AI工具正在让“低成本、高还原”的真人相关创作成为可能。本文将深入拆解AI真人场景打造的全流程,从风格探索到工具协同,再到3D化应用技巧,助力创作者在技术浪潮中找到高效路径。

数字创作领域,AI 技术的爆发式发展正重构内容生产逻辑,其中 “真人及3D场景”,更是打破了虚拟与现实的边界。

从影视级虚拟场景到个性化数字人,从游戏角色定制到商业广告合成,AI 工具正让 “低成本、高还原” 的真人相关创作成为可能。

本文将拆解 AI 真人场景打造的全流程,解析真人 Lora 的 3D 化应用技巧,助力创作者在技术浪潮中找到高效路径。

01 AI真人场景打造全流程

AI 真人场景的打造并非简单的 “一键生成”,而是需要从风格定位到工具协同的系统化流程。只有明确每个环节的核心目标,才能让最终成果既贴合需求,又具备独特性。

1. 风格探索 确定调性

风格是场景的灵魂,也是创作的 “第一锚点”。在启动 AI 真人场景打造前,“风格探索” 需要完成两个核心任务:需求对齐与风格具象化。

首先,通过用户访谈或需求问卷明确场景的核心用途 —— 是品牌宣传的人物形象,还是运营活动的人物场景?不同用途决定了风格的底层逻辑。

以58到家品牌劳动者场景为例,经过风格探索,58到家影像风格确定为简洁品质感,背景偏明亮、服务专业的调性。在确定风格后,接下来我们就要进行人物场景创作阶段。

2. 豆包辅助流程拆解

关于人物场景创作我们有很多AI工具可选,首先向大家介绍的是运用豆包辅助出图,豆包的核心价值在于将 “抽象需求” 转化为 “可执行的步骤清单”,降低创作门槛。 以下是具体流程:

(1)画面要素梳理。比如:“30岁专业女家政人员,身着黑色58到家围裙、蓝绿色T恤,手里拿着抹布正在擦桌子,明亮高级的客厅空间”。以上的描述中包含了人物、地点、事件等要素特征,我们按照自己的需求梳理好画面要素。

(2)运用AI书写关键词。前期我们已经梳理好了画面要素,书写关键词就是对于我们核心画面要素进行一个扩写的过程。

这里介绍两种用AI书写关键词的方法:

第一种方法:内容指令法,也就是我们把梳理好的要素给到AI,让AI按照给到的内容框架进行扩写描述。

第二种方法:案例参考法,也就是我们把一个符合预期的关键词案例喂给AI,让他严格按照其格式书写关键词。 以上两种方法对于书写关键词来讲都非常高效。

(3)抽卡图像细节调整。最后进入了运用豆包进行图像创作阶段,在出图的过程中我们可以反复优化关键词来得到自己想要的场景,最终运用ps来优化图像。

3. SD辅助流程拆解

接下来介绍的是SD辅助流程的拆解,SD作为图像核心生成工具,其流程拆解需聚焦“书写关键词–配置(训练)人物lora –配置参数三个核心环节。

(1)书写人物关键词

关于人物关键词的书写上述我们介绍了两种方法,在这里也可以灵活尝试使用。在书写关键词的时候如果lora模型有触发词,一定描述在里面。

(2)配置(训练)人物lora模型

Lora模型是SD出图的关键,它直接影响了出图的风格调性。

关于lora训练共包含:风格一致的训练素材、优质的底膜以及多轮的迭代训练3个要素。

关于训练素材集的制作,我们以最低成本实现人物形象的固定,对于真人的素材集可以有两种类型,一种是通过拍摄,另外就是借助ai来生成素材集。

我们先以58到家的拍摄素材为例,训练素材一般需要三种类型图片,第一种就是主体形象多角度的图,另外就是主体的不同动作图,最后就是主体的特写图。如果我们没有拍摄的图片,我们用AI也可以快速产出人物一致性的图像。关于底模一般选择flux模型比较稳定,最终通过多轮的训练就可以得到我们想要的lora模型。

(3)参数配置

关于参数可以根据lora模型特征调整迭代步数,其他参数可以灵活进行配置。

02 真人Lora的3D化应用

上述我们提到了58到家保洁真人lora模型,如果我们想要3D风格的保洁形象,此刻再去训练一个3D版本的lora时间成本太高了。

那么如何去解决这个问题呢?

其实方法很简单,就是在SD中在真人lora 的基础之上叠加使用一个3D风格的lora,这样我们就可以得到一个3D版本的58到家保洁形象。

当然在这个过程中,我们叠加的3D风格lora不同,最终出图的风格也不一样。

比如我们叠加的模型如果是夸张形体的3D风格lora,那么最终输出的人物角色就是形体比较夸张的特点(如下图)。

除此之外,我们还可以调控真人lora与叠加3d模型的权重来调试最终的效果。

权重调控堪称这种叠加技法的 “精密旋钮”,直接决定着最终人物特征与 3D 风格的平衡关系。

当真人 LoRA 权重保持在 0.8 – 1.0 区间,3D 风格 LoRA 权重控制在 0.2 – 0.3 时,画面会呈现整体微3D效果。

若将两者权重配置为1:1时,则会触发更深度的风格融合,此时真人和3d模型都会展现各自明显的特征。这种灵活可控的创作方式,既规避了重复训练模型的成本,又为品牌形象的多元化表达打开了广阔空间 —— 只需通过滑块拖动完成权重配比,就能让同一个保洁形象在职业场景与趣味传播场景中自由切换,真正实现 “一次训练,多次复用,千变万化”。因此我们可以采用这种方法多去做一些创意型的尝试,会产出很多意向不到的效果。

03 Lora创意组合技巧

除了上述的真人与3D风格lora模型组合之外,任意风格的lora都可以进行叠加组合,比如真人保洁lora与扁平风模型的组合就会输出扁平插画风的保洁阿姨形象。lora模型的自由组合,如同为创作者打开了一扇通往无限创意的大门。它打破了风格之间的壁垒,让各种类型的 lora 模型能够随意叠加、融合,无需受限于固定的搭配模式。

Lora组合的核心魅力在于其高度的灵活性与开放性。无论是什么风格的 lora,无论是偏向写实还是奇幻,是传统还是现代,都能在组合中找到独特的契合点。它不只是简单地将不同元素拼凑在一起,而是促成了风格间的深度交融与重构,让原本独立的美学特质相互碰撞、渗透,催生出全新的视觉表达形式。

04 写在最后

AI 真人场景打造与 3D 化应用,本质是 “技术工具” 与 “创作思维” 的协同。

从 2D 场景的风格锚定,到豆包与 SD 的流程拆解,再到 3D 化的模型叠加与 Lora 组合,每个环节的核心都是 “让技术服务于创意”—— 技术决定了 “能做到什么”,而对需求的理解、对细节的把控,决定了 “能做到多好”。

未来,随着 AI 生成精度的提升,真人场景的应用边界将进一步拓展。

但无论技术如何迭代,“人的创造力” 始终是核心 ——AI 是画笔,而创作者的想法,才是让画面拥有灵魂的光源。 愿每个创作者都能在技术浪潮中,找到属于自己的创作节奏,让数字世界里的 “真人场景”,既精准落地需求,又充满独特的人文温度。

作者:李石林

本文由人人都是产品经理作者【58UXD】,微信公众号:【58UXD】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。