AI 短剧开拍前的「定妆」到底在定什么:从角色脸到场景道具的视觉资产清单
AI 短剧里角色每场换一张脸、衣服颜色飘来飘去,根因不是模型差,而是开拍前没有一份被全链路共用的视觉标准。定妆做的就是这件事:把「这个人、这个地方、这件东西长什么样」提前锁死。
定妆不是美术环节,是生产准入门槛
很多团队把定妆理解成「出几张角色图挑一挑」,挑完就直接进视频生成。结果是第 1 集主角穿黑西装,第 3 集变成灰夹克,第 5 集连脸型都不对了——因为每一次生成,模型都在重新想象这个人。
定妆(Look Development)是在开拍前,把一部剧里所有会反复出现的视觉元素——人物面容与造型、场景空间、关键道具——统一出图、确认、落库,变成后续每场戏只能引用、不能即兴发挥的资产。
它和传统剧组的定妆照、场景气氛图、道具设计图是同一个工种逻辑,只是在 AI 短剧里,这份资产不是给灯光师和道具组看的,是给视频生成模型看的「标准答案」。
没有定妆,AI 在每场戏都重新选角
传统剧组里,演员签了约、试了妆、拍了定妆照,之后几十集都是同一张脸、同一套衣服(除非剧本要求换装)。AI 短剧没有这个「签约」动作——如果你不给模型一张固定的参考图,它每生成一场都相当于重新开了一次选角会。
常见的翻车几乎都能追溯到定妆缺失:
| 翻车现象 | 根因 |
|---|---|
| 主角每集脸不一样 | 没有锁定的人物定妆图,模型每次自由发挥 |
| 同一场戏衣服颜色前后不一致 | 服装只写在剧本文字里,没有视觉锚点 |
| 场景一会儿现代一会儿古风混搭 | 场景没有独立的气氛图,模型凭文字猜 |
| 关键道具(玉佩、合同、戒指)长得不一样 | 道具没有提前出图,每场重新生成 |
| 人物画风和视频画风断层(立绘日漫、视频写实) | 人物、场景、视频没有走同一条画风路径 |
定妆解决的不是「好不好看」的审美问题,是「是不是同一个东西」的连续性问题。
一份完整的定妆清单包含三类资产
专业流程里,定妆不是只做角色。一部剧的视觉资产分三类,缺任何一类都会在拍摄时出问题:
1. 人物定妆
每个有台词或反复出场的角色,至少需要一张正面定妆图,锁定:
- 面容特征(脸型、五官、年龄感)
- 发型与发色
- 服装款式与主色调
- 气质与表情基调
有穿越、闪回、换装剧情的角色,需要为每个时代 / 状态各出一套定妆,拍摄时按场景自动匹配对应造型。
2. 场景定妆
每个反复出现的场景(主角家、公司办公室、古代大殿、街角咖啡店)需要一张独立的场景气氛图。场景图里严禁出现人物——它的任务是交代空间、光线、色调、陈设,人物是后期合成进去的。如果场景图里带了人,视频生成时那个人可能会「长出来」抢戏。
3. 道具定妆
剧本里反复出现、推动剧情的道具(传家宝、凶器、手机、合同、婚戒),需要单独出图。道具的提取应该以拍戏视角按集梳理,全剧合并成一份道具目录,避免第 2 集出现的玉佩到第 8 集换了形状。
画风统一:三类资产必须走同一条路
定妆最容易被忽略的一点是:人物立绘、场景立绘、道具立绘、最终视频提示词,必须共用同一套画风设定。
如果人物用的是「九十年代日漫」手册出图,场景用的是「都市写实」手册出图,视频提示词又没有注入统一的风格标签,出来的成片就是拼贴的——人物像从另一部动画片里抠进来的。
成熟的做法是在定妆开始前先选定画风手册,之后所有出图和视频生成都沿着这条路径走。画风手册至少应该覆盖:人物的面容锚点与材质表现、场景的光影与色调倾向、视频端的风格标签。
为什么必须「先定妆再开拍」
「先拍再调」在传统影视里是补拍,在 AI 短剧里是重做。原因很直接:
- 视频生成没有「替换角色」的后期功能。 脸错了就是整场重出,不能像 Photoshop 那样换头。
- 没有定妆图,提示词写得再细也压不住模型的随机性。 文字描述「黑色西装」可以生成一百种黑西装,参考图只有一种。
- 一致性靠资产,不靠运气。 你可以赌一次生成脸不歪,但赌不了 100 集都不歪。
- 定妆是一次性成本,重拍是反复性成本。 前期花时间锁一张图,后面每场戏直接引用,省的是几十集的返工。
一个实用的类比:定妆图相当于剧组里演员签完约拍的那张定妆照。有了它,导演、摄影、灯光、化妆所有人都知道这个人长什么样;没有它,每天开工都是第一天见面。
开拍前的齐套检查
正式生成视频前,应该对每一场戏做一次资产齐套校验:
- 本场出场的人物,是否都有状态为「已完成」的定妆图?
- 本场发生的场景,是否有对应的场景气氛图?
- 本场出现的关键道具,是否有道具图?
- 所有资产是否来自同一套画风手册?
缺任何一项,系统应该给出提醒。专业流程会先补齐资产再开拍;当然也允许跳过走纯文字路径——但纯文字生成的一致性通常更差,这是一种有意识的取舍,不是默认状态。
定妆做不到的事
定妆是一致性的基础,但不是万能钥匙,有几个边界需要提前知道:
- 定妆图不自动等于视频里脸 100% 一致。 最终观感还取决于视频提示词是否遵守「有参考图就不再用文字描写服装外观」的规则,以及模型本身的能力。
- 定妆不替你做审美判断。 图出得好不好看、角色气质对不对,仍然需要人确认。
- 跨场的连续动作不被定妆解决。 定妆锁的是静态视觉标准,场与场之间的动作衔接靠分镜和剪辑。
- 定妆资产需要维护。 剧情推进中角色受伤、换装、身份变化,要及时更新或新增对应状态的定妆图,不能一直用旧图。
定妆的价值不是让 AI 变成零失误的机器,而是把「每场重新想象」变成「每场引用标准」——把重复的、易漂移的部分变成可约束的流水线,审美判断仍然坐在人这边。
常见问题
定妆是不是只给主角做就行了?
不是。有台词或反复出场的配角、主要场景、推动剧情的关键道具都需要定妆。群演和泛指角色(如「路人」「服务员」)不需要单独定妆,避免挤占参考槽位。
定妆图和视频生成的画风不一致怎么办?
根因通常是人物、场景、视频没有共用同一条画风路径。正确做法是在定妆开始前先选定画风手册,之后所有立绘和视频提示词都沿用这套手册的风格设定,不要中途切换。
能不能跳过定妆直接用文字描述生成?
可以,系统通常允许跳过走纯文字路径,但一致性会明显更差——衣服颜色、面容、道具每场都可能飘。专业流程应该先定妆再开拍,纯文字路径只适合对一致性要求不高的快速试拍。
角色有换装或穿越剧情,定妆怎么处理?
为每个时代、每套服装、每种状态(如受伤后、身份揭露后)各出一套定妆图。拍摄时系统会根据场景的时代关键词和剧情状态,自动匹配对应造型的定妆图作为参考。
场景定妆图里为什么不能有人物?
场景图的任务是交代空间、光线、色调和陈设。如果图里带了人,视频生成时模型可能会把那个人物也生成出来,导致画面里多出多余的人或人物重叠。场景图只画环境,人物通过单独的定妆图引入。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com