开拍前的齐套校验:缺哪张图会毁掉这一场

猫斯卡编辑部 | 最后更新日期

AI 短剧一场戏拍崩,多半不是模型不行,而是开拍前参考图没齐。缺场景图会串景,缺人物定妆会换脸,缺道具图会凭空变出东西——齐套校验就是开拍前的制片清单。

为什么要在「按下生成」之前做齐套校验

很多团队用 AI 拍短剧的流程是:写完剧本,直接把整集丢给视频模型,等出片。结果出来一看,主角第三场换了张脸,第五场古装场景里冒出空调外机,第七场关键证据玉佩变成了手表。

这些问题不是出在「生成」这一步,而是出在开拍前没有把这场戏需要的视觉资产清点齐。

齐套校验是一份开拍前的制片清单:在生成视频提示词之前,系统按场检查这场戏需要哪些场景图、哪些道具图、哪些人物定妆图,缺了就弹出清单,引导先去绘制,而不是静默地用纯文字硬生成。

它的本质是把传统剧组里「美术、道具、造型交齐了才能开机」这条纪律,搬到 AI 生产线上。

一场戏到底需要哪几类图

每场戏的参考素材表按固定顺序构建,优先级从高到低:

顺序素材类型作用缺了会怎样
1场景图锚定内/外景、地点、日夜、美术风格模型自由发挥场景,容易出现时代错误物品、风格漂移
2本场道具图锚定关键道具的外观、材质、颜色道具凭空生成,关键证物前后不一致,甚至变成别的东西
3人物定妆图锚定演员的脸、服装、造型换脸、换装、年龄漂移,主角变成路人脸

这个顺序不是随意排的。场景是容器,道具是容器里的物件,人物是在容器里表演的主体。模型在生成时如果拿到的是「场景 → 道具 → 人物」这个顺序的参考,它的注意力分配是稳定的;反过来,如果只给人物图不给场景,背景就会随机。

场景图:空镜纪律

场景图有一条硬规矩:严禁出现人物

原因很简单——场景图的任务是告诉模型「这个地方长什么样」,如果图里已经站了一个人,模型在生成时会把那个人物的轮廓、服装甚至脸当成场景的一部分,和真正要出场的角色打架。

场景从剧本里自动解析为「内/外 | 地点 | 日夜」三个维度,不需要手填表格。比如剧本写「内景·总裁办公室·日」,系统就知道这场需要一张「白天的总裁办公室内景空镜」。

道具图:以道具师的视角提取

道具不是用户手动列清单,而是系统以「道具师」的拍戏视角,按集从剧本里提取道具的原始称呼,全剧合并成一份道具编目。

比如剧本里写「她攥紧了那块刻着龙纹的玉佩」,道具师就会把「刻着龙纹的玉佩」提出来,而不是笼统地写「首饰」。原始称呼越具体,出图越准,跨集一致性越好。

道具支持手动纳入或排除。如果这场戏的餐桌上有一盘水果但它不是剧情焦点,可以排除掉,避免无关道具挤占参考槽位;反之,如果一把扇子是本集关键证物,必须手动确保它在本场的道具图里。

人物定妆图:有图就不写外观

这是 AI 短剧一致性最核心的一条规则,值得单独强调:

有参考图的人物,禁止再用文字描写服装/外观;以参考图为准,文字只写动作、表情、伤情。

这条规则直接针对 AI 视频最经典的翻车场景:提示词里写了「穿着红色长裙的女人」,参考图里她穿的是白色旗袍,模型在两个信号之间摇摆,出来的结果可能是红白相间的陌生裙子,甚至换了一张脸。

定妆图确认时有硬门禁:阵容齐全、姓名合法、视觉字段完整、主角与创意简报对齐。不过关不能进入下一阶段。

齐套校验的工作流

齐套校验不是一个单独的「按钮」,而是嵌在开拍流程里的一道闸门:

  1. 打开某集视频工作台,系统自动按场列出这场需要的素材清单
  2. 逐场检查:场景图是否已绘制、本场道具是否有图、出场人物是否有定妆
  3. 弹出缺失清单:缺什么就引导去画什么,可以当场绘制,也可以从历史版本里选
  4. 允许跳过:如果有意走纯文字路径,可以确认跳过——但系统会提醒,纯文字路径的质量通常更差
  5. 齐套后生成提示词:提示词只引用本场素材,禁止串戏

这里有一个关键设计:跳过是允许的,但不是静默的。它像一个制片助理站在旁边说「这场女主没定妆,确定要拍吗?」而不是趁你不注意就用文字硬生成了。

手动绑定:处理剧本称呼和档案不一致

剧本里的角色称呼和档案里的名字不一定完全对应。比如剧本里写「那个警官推门进来」,档案里这个角色叫「李强」。

齐套校验时支持手动角色绑定:把剧本里的「警官」绑到档案里「李强」的定妆图上。如果不绑,模型会把「警官」当成一个新角色,凭空生成一张脸。

同理,穿越或闪回题材会涉及时代造型路由:系统按场景地点的关键词判定这是现代还是古代,取人物定妆图时优先匹配对应造型。比如同一个角色,现代戏用西装定妆,古代戏用汉服定妆,不会搞混。

缺图的代价:什么情况能省,什么情况不能省

不是每场戏所有图都缺一不可。理解不同缺失的代价,才能做出合理的取舍。

缺失类型风险等级典型后果建议
缺主角定妆图极高换脸、换装、主角辨识度崩塌不可省,必须先定妆
缺关键道具图核心证物变形、前后不一致剧情关键道具不可省
缺场景图中高背景乱入、时代错误、风格漂移主要场景不可省,过场空镜可酌情
缺群演/路人图路人脸随机,但不影响主线可省,群演从主演名单剥离
缺非关键道具图桌上摆件随机,不影响剧情可省,可手动排除

专业流程的原则很简单:先定妆,再开拍。主角定妆和关键道具是底线,场景图是质量保障,群演和非关键道具可以灵活处理。

诚实边界:齐套校验做不到什么

齐套校验是一道重要的闸门,但它不是万能的,有几个边界需要讲清楚:

  1. 它检查的是「有没有图」,不是「图好不好」。一张画崩了的定妆图,齐套校验会认为「已齐套」,但拍出来照样会出问题。图的质量终审在人。
  2. 参考图不是强制门禁。缺图会提醒,但允许跳过走纯文字路径——纯文字路径质量通常更差,所以专业流程应该先补齐再拍。
  3. 角色一致性依赖定妆资产链路,不是人脸嵌入校验。时代造型靠规则选图,最终观感仍取决于立绘质量,以及提示词是否遵守「有图不写外观」。
  4. 提示词里的参考代号靠规范引导,不做二次硬拼。创作者在审词时仍应确认参考代号齐全、对应正确。

齐套校验解决的是「该有的东西有没有」的问题,「东西好不好」和「指令对不对」仍然需要人来把关。

把片场纪律搬进 AI 生产线

传统剧组里,不会出现「演员没试妆就开机」「道具没准备就开拍」的情况——因为所有人都在现场,缺什么一眼就能看见。

AI 生产的危险在于,生成按钮太容易按了,缺一张图不会有人喊「等一下」,模型只会默默用想象力补全,然后在成片里给你一个「惊喜」。

齐套校验做的事情,就是在按下生成之前,替你喊那一声「等一下」。

猫斯卡的定位是可规模化生产的 AI 短剧操作系统——把专业流程固化进产品,而不是宣称无需人类、零失误出片。在猫斯卡的视频链路里,每场戏开拍前会自动检查场景、道具、人物定妆图是否齐全,弹出缺失清单引导补齐;你可以查看每场的参考素材表、手动绑定角色、纳入或排除道具,确认齐套后再生成提示词、提交出片。审美判断仍然坐在人这边,系统负责的是不让「缺了一张图」这种低级失误毁掉整场戏。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com