开拍前的齐套校验:缺哪张图会毁掉这一场
AI 短剧一场戏拍崩,多半不是模型不行,而是开拍前参考图没齐。缺场景图会串景,缺人物定妆会换脸,缺道具图会凭空变出东西——齐套校验就是开拍前的制片清单。
为什么要在「按下生成」之前做齐套校验
很多团队用 AI 拍短剧的流程是:写完剧本,直接把整集丢给视频模型,等出片。结果出来一看,主角第三场换了张脸,第五场古装场景里冒出空调外机,第七场关键证据玉佩变成了手表。
这些问题不是出在「生成」这一步,而是出在开拍前没有把这场戏需要的视觉资产清点齐。
齐套校验是一份开拍前的制片清单:在生成视频提示词之前,系统按场检查这场戏需要哪些场景图、哪些道具图、哪些人物定妆图,缺了就弹出清单,引导先去绘制,而不是静默地用纯文字硬生成。
它的本质是把传统剧组里「美术、道具、造型交齐了才能开机」这条纪律,搬到 AI 生产线上。
一场戏到底需要哪几类图
每场戏的参考素材表按固定顺序构建,优先级从高到低:
| 顺序 | 素材类型 | 作用 | 缺了会怎样 |
|---|---|---|---|
| 1 | 场景图 | 锚定内/外景、地点、日夜、美术风格 | 模型自由发挥场景,容易出现时代错误物品、风格漂移 |
| 2 | 本场道具图 | 锚定关键道具的外观、材质、颜色 | 道具凭空生成,关键证物前后不一致,甚至变成别的东西 |
| 3 | 人物定妆图 | 锚定演员的脸、服装、造型 | 换脸、换装、年龄漂移,主角变成路人脸 |
这个顺序不是随意排的。场景是容器,道具是容器里的物件,人物是在容器里表演的主体。模型在生成时如果拿到的是「场景 → 道具 → 人物」这个顺序的参考,它的注意力分配是稳定的;反过来,如果只给人物图不给场景,背景就会随机。
场景图:空镜纪律
场景图有一条硬规矩:严禁出现人物。
原因很简单——场景图的任务是告诉模型「这个地方长什么样」,如果图里已经站了一个人,模型在生成时会把那个人物的轮廓、服装甚至脸当成场景的一部分,和真正要出场的角色打架。
场景从剧本里自动解析为「内/外 | 地点 | 日夜」三个维度,不需要手填表格。比如剧本写「内景·总裁办公室·日」,系统就知道这场需要一张「白天的总裁办公室内景空镜」。
道具图:以道具师的视角提取
道具不是用户手动列清单,而是系统以「道具师」的拍戏视角,按集从剧本里提取道具的原始称呼,全剧合并成一份道具编目。
比如剧本里写「她攥紧了那块刻着龙纹的玉佩」,道具师就会把「刻着龙纹的玉佩」提出来,而不是笼统地写「首饰」。原始称呼越具体,出图越准,跨集一致性越好。
道具支持手动纳入或排除。如果这场戏的餐桌上有一盘水果但它不是剧情焦点,可以排除掉,避免无关道具挤占参考槽位;反之,如果一把扇子是本集关键证物,必须手动确保它在本场的道具图里。
人物定妆图:有图就不写外观
这是 AI 短剧一致性最核心的一条规则,值得单独强调:
有参考图的人物,禁止再用文字描写服装/外观;以参考图为准,文字只写动作、表情、伤情。
这条规则直接针对 AI 视频最经典的翻车场景:提示词里写了「穿着红色长裙的女人」,参考图里她穿的是白色旗袍,模型在两个信号之间摇摆,出来的结果可能是红白相间的陌生裙子,甚至换了一张脸。
定妆图确认时有硬门禁:阵容齐全、姓名合法、视觉字段完整、主角与创意简报对齐。不过关不能进入下一阶段。
齐套校验的工作流
齐套校验不是一个单独的「按钮」,而是嵌在开拍流程里的一道闸门:
- 打开某集视频工作台,系统自动按场列出这场需要的素材清单
- 逐场检查:场景图是否已绘制、本场道具是否有图、出场人物是否有定妆
- 弹出缺失清单:缺什么就引导去画什么,可以当场绘制,也可以从历史版本里选
- 允许跳过:如果有意走纯文字路径,可以确认跳过——但系统会提醒,纯文字路径的质量通常更差
- 齐套后生成提示词:提示词只引用本场素材,禁止串戏
这里有一个关键设计:跳过是允许的,但不是静默的。它像一个制片助理站在旁边说「这场女主没定妆,确定要拍吗?」而不是趁你不注意就用文字硬生成了。
手动绑定:处理剧本称呼和档案不一致
剧本里的角色称呼和档案里的名字不一定完全对应。比如剧本里写「那个警官推门进来」,档案里这个角色叫「李强」。
齐套校验时支持手动角色绑定:把剧本里的「警官」绑到档案里「李强」的定妆图上。如果不绑,模型会把「警官」当成一个新角色,凭空生成一张脸。
同理,穿越或闪回题材会涉及时代造型路由:系统按场景地点的关键词判定这是现代还是古代,取人物定妆图时优先匹配对应造型。比如同一个角色,现代戏用西装定妆,古代戏用汉服定妆,不会搞混。
缺图的代价:什么情况能省,什么情况不能省
不是每场戏所有图都缺一不可。理解不同缺失的代价,才能做出合理的取舍。
| 缺失类型 | 风险等级 | 典型后果 | 建议 |
|---|---|---|---|
| 缺主角定妆图 | 极高 | 换脸、换装、主角辨识度崩塌 | 不可省,必须先定妆 |
| 缺关键道具图 | 高 | 核心证物变形、前后不一致 | 剧情关键道具不可省 |
| 缺场景图 | 中高 | 背景乱入、时代错误、风格漂移 | 主要场景不可省,过场空镜可酌情 |
| 缺群演/路人图 | 低 | 路人脸随机,但不影响主线 | 可省,群演从主演名单剥离 |
| 缺非关键道具图 | 低 | 桌上摆件随机,不影响剧情 | 可省,可手动排除 |
专业流程的原则很简单:先定妆,再开拍。主角定妆和关键道具是底线,场景图是质量保障,群演和非关键道具可以灵活处理。
诚实边界:齐套校验做不到什么
齐套校验是一道重要的闸门,但它不是万能的,有几个边界需要讲清楚:
- 它检查的是「有没有图」,不是「图好不好」。一张画崩了的定妆图,齐套校验会认为「已齐套」,但拍出来照样会出问题。图的质量终审在人。
- 参考图不是强制门禁。缺图会提醒,但允许跳过走纯文字路径——纯文字路径质量通常更差,所以专业流程应该先补齐再拍。
- 角色一致性依赖定妆资产链路,不是人脸嵌入校验。时代造型靠规则选图,最终观感仍取决于立绘质量,以及提示词是否遵守「有图不写外观」。
- 提示词里的参考代号靠规范引导,不做二次硬拼。创作者在审词时仍应确认参考代号齐全、对应正确。
齐套校验解决的是「该有的东西有没有」的问题,「东西好不好」和「指令对不对」仍然需要人来把关。
把片场纪律搬进 AI 生产线
传统剧组里,不会出现「演员没试妆就开机」「道具没准备就开拍」的情况——因为所有人都在现场,缺什么一眼就能看见。
AI 生产的危险在于,生成按钮太容易按了,缺一张图不会有人喊「等一下」,模型只会默默用想象力补全,然后在成片里给你一个「惊喜」。
齐套校验做的事情,就是在按下生成之前,替你喊那一声「等一下」。
猫斯卡的定位是可规模化生产的 AI 短剧操作系统——把专业流程固化进产品,而不是宣称无需人类、零失误出片。在猫斯卡的视频链路里,每场戏开拍前会自动检查场景、道具、人物定妆图是否齐全,弹出缺失清单引导补齐;你可以查看每场的参考素材表、手动绑定角色、纳入或排除道具,确认齐套后再生成提示词、提交出片。审美判断仍然坐在人这边,系统负责的是不让「缺了一张图」这种低级失误毁掉整场戏。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com