把缺图拦在提交之前:AI 竖屏短剧开拍前的资产齐套校验流程
AI 短剧最常见的翻车,不是模型不会拍,而是开拍时参考资产没齐。缺一张场景图、人物定妆图或关键道具图,模型就会在这一场里临时补全想象,结果就是换景、换装、道具消失,甚至角色像另一个人。
为什么要把齐套校验放在提交出片之前
很多团队把“素材准备”理解成前期美术的事:角色立绘画完、场景图出完、道具图存好,就以为可以开拍。但真正决定一场戏能不能稳定生成的,不是全剧素材库里有没有这些图,而是这一场绑定的参考图是否齐全、可读、状态正确。
开拍前的齐套校验,本质上是一次镜头级核对:
- 这场戏发生在哪个场景?场景图是否已完成?
- 这场戏有哪些道具必须出现?道具图是否已完成?
- 这场戏出场哪些人物?人物定妆图是否已完成?
- 是否有同名角色、客串称呼、群演泛指需要手动绑定?
- 是否有无关道具被错误纳入,挤占参考槽位?
如果这些问题到提交出片时才暴露,模型不会停下来等你补图,它只会根据文字和已有参考自行补全。短剧制作里最常见的“这一场怎么突然换了个房间”“主角衣服颜色变了”“关键证据不见了”,很多都不是模型能力问题,而是资产没有在正确的时间进入正确的场。
齐套校验不是看素材库,而是看“本场素材表”
本场素材表是按单场镜头生成的参考清单,用来告诉视频生成环节:这一场可以引用哪些场景、道具和人物图像。它不是全剧资产总表,也不是美术文件夹,而是拍摄前最后一道核对单。
一个专业流程里,每场的参考素材应按固定顺序组织:
| 顺序 | 参考类型 | 作用 | 缺图风险 |
|---|---|---|---|
| 1 | 场景图 | 确定内外景、空间结构、日夜氛围 | 场景被模型重想,房间、街道、宫殿可能变形 |
| 2 | 本场道具图 | 固定关键物件外观 | 道具失忆、证据变样、信物前后不一致 |
| 3 | 人物定妆图 | 固定角色面容、服装、造型 | 换脸、换装、年龄和气质漂移 |
这个顺序很重要。场景先建立空间,道具再进入空间,人物最后在空间里行动。如果顺序混乱,或者把无关素材塞进本场,模型容易抓错视觉重点。
更关键的是:有图才占槽位,没有图就应明确标注“仅文字”,而不是假装已经绑定。齐套校验的价值,就在于把这些“仅文字”的风险点提前暴露出来。
缺哪张图,会分别毁掉什么
缺场景图:空间会被重新发明
场景图负责告诉模型“这是哪里”。如果缺场景图,模型只能根据剧本里的“办公室”“宴会厅”“审讯室”“古代书房”等词自行生成。文字越短,发挥空间越大。
常见后果包括:
- 同一场办公室在不同 take 里墙面、窗户、桌椅布局不一致;
- 古装场景混入现代灯具、插座、瓷砖等元素;
- 日戏和夜戏氛围不稳定;
- 角色站位和镜头调度缺少空间依据。
场景图还有一条容易被忽略的纪律:场景空镜不应出现人物。如果场景图里已经有人,模型可能把图中人物当成角色参考,导致多余人物、身份错乱或构图被干扰。
缺道具图:剧情证据最容易消失
短剧非常依赖道具推动剧情:合同、玉佩、录音笔、亲子鉴定、手机聊天记录、钥匙、药瓶。道具一旦没有图,模型只会按类别生成一个“像那么回事”的物件。
这会带来三类问题:
- 识别问题:观众看不清这是什么,剧情信息传达失败;
- 连续问题:上一集是黑色手机,下一集变成白色手机;
- 焦点问题:关键道具被背景杂物淹没,镜头没有拍到位。
道具准备不应靠人工临时填表,而应以拍戏视角从剧本中提取原始称呼,再按集合并成道具目录。比如剧本写“半块玉佩”,道具就应叫“半块玉佩”,而不是后期统一改成模糊的“古代饰品”。称呼越贴近剧本,绑定越不容易错。
缺人物定妆图:角色一致性失去锚点
人物定妆图是角色一致性的核心资产。缺图时,模型只能根据“年轻女性”“霸总”“老管家”这类词生成角色,结果高度不稳定。
即使有人物图,如果图的状态不对,也不能算齐套。可用于拍摄的人物参考应满足:
- 立绘状态已完成,而不是待重绘或生成失败;
- 文件可读,不是损坏或过期链接;
- 性别等硬规则明确;
- 服装和造型符合本场时代与情境;
- 主角与创意简报、故事档案中的人物设定一致。
这里要特别强调一条规则:有参考图的人物,禁止再用文字描写服装和外观;文字只写动作、表情、伤情。如果提示词一边引用定妆图,一边又写“身穿红色长裙”,而定妆图里是蓝色,模型就会收到冲突指令,换装概率大幅上升。
齐套校验的五步流程
第一步:从剧本结构化解析场次
开拍前先确认场次信息是否准确。每场至少应拆出:
- 内景或外景;
- 地点;
- 日或夜;
- 出场人物;
- 关键动作;
- 关键道具;
- 台词或音效信息。
场次不是手填表格,而应从剧本结构中解析。这样能避免“剧本里写的是客厅,拍摄清单里变成餐厅”这类低级错误。
第二步:按场生成参考素材表
每一场都应有自己的素材表,而不是全剧共用一个素材池。素材表至少要回答:
- 本场场景图是哪张?
- 本场道具图有哪些?哪些必须出现?哪些应排除?
- 本场人物图分别绑定谁?
- 有没有“仅文字”的缺口?
这一步相当于片场里的美术、道具、服化道联合点名。不是看“我们有没有这些东西”,而是看“这一场带没带对东西”。
第三步:处理角色称呼和客串指代
剧本里的人物称呼不一定总与档案名一致。比如档案里叫“李强”,剧本里写“李警官”“那人”“队长”。如果不做手动绑定,系统可能把它当成新角色,或者错误绑定到其他人。
手动角色绑定主要解决三类情况:
| 情况 | 处理方式 |
|---|---|
| 职务称呼 | 将“警官”“总裁”“师傅”绑定到档案角色 |
| 客串指代 | 将“黑衣人”“服务员”等明确是否需要定妆 |
| 群演泛指 | 从可绘制主演名单中剥离,避免挤占定妆槽位 |
群演和泛指角色不应占用主演参考槽位。否则真正需要稳定的主角可能拿不到足够参考权重。
第四步:核对时代造型
穿越、闪回、回忆杀、前世今生这类题材,同一角色可能有多套造型。齐套校验不能只看“这个角色有没有图”,还要看“这一场该用哪套图”。
时代造型路由通常按场景地点关键词判断现代或古代,再为人物选择对应定妆图。例如:
- 现代办公室场景,优先使用现代装;
- 古代宫殿闪回,优先使用古装造型;
- 同一角色受伤后,应参考当前状态记录,而不是初始定妆。
这也是故事档案的价值:人物状态不是固定不变的,伤痕、身份变化、服装变化都应被记录并在续拍时调用。
第五步:决定补齐、跳过还是调整提示词
齐套校验后通常有三种选择:
- 先补齐资产再开拍:适合主角、主场景、关键道具,是最稳妥的生产方式;
- 有意跳过,走纯文字路径:可以拍,但质量通常更差,适合非关键过场;
- 调整本场镜头设计:如果道具无法及时出图,可以减少道具特写,改用反应镜头或台词交代,但这属于创作妥协。
成熟团队会把第二种选择当成例外,而不是默认路径。因为纯文字生成不是“省了一步”,而是把一致性风险留给了后期。
提交前还应检查的四个细节
参考图版本是否正确
同一个人物、场景或道具可能经历多次重绘。拍摄时应确认使用的是已确认版本,而不是历史草稿。若需要回退,也应明确选择历史版本中的某一张,避免误拿旧图。
道具是否被错误纳入或排除
不是所有出现在道具目录里的物件都要进每一场。无关道具会分散模型注意力,甚至挤占参考槽位。开拍前应检查:
- 本场剧情必须出现的道具是否已纳入;
- 与本场无关的道具是否已排除;
- 道具名称是否与剧本原始称呼一致。
提示词是否与参考图冲突
提示词不是越长越好。如果已有参考图,文字应避免重复描述外观,尤其不要和参考图争抢服装、颜色、脸型、材质等信息。更稳的写法是:
- 人物:写动作、表情、视线、伤情;
- 场景:写调度、光影、氛围;
- 道具:写位置、使用方式、镜头强调;
- 风格:写统一的影像质感,而不是另起一套世界观。
本场是否需要多 take
齐套校验通过,不等于一次就能拍好。复杂动作、多人互动、强烈运镜仍可能失败。专业做法是为关键场保留多 take,通过改词、换图、调整运镜后重拍,再从历史 takes 中择优。
一条可直接落地的开拍前检查单
下面这张清单可以放在每集开拍前使用:
| 检查项 | 通过标准 |
|---|---|
| 场次信息 | 内外景、地点、日夜已从剧本解析正确 |
| 场景图 | 本场场景已有完成状态的空镜图 |
| 人物图 | 本场出场人物均绑定正确定妆图 |
| 道具图 | 关键道具已绑定,无关道具已排除 |
| 角色称呼 | 职务、客串、泛指均已处理或剥离 |
| 时代造型 | 穿越、闪回场景使用对应造型 |
| 提示词 | 有图人物不再重复描写服装外观 |
| 文件状态 | 所有引用图片完成且可读 |
| 风险确认 | 缺图项已决定补齐或有意跳过 |
这张清单不追求复杂,追求的是每场都能执行。AI 短剧生产一旦进入多集并行,最怕的不是某一场拍坏,而是同类错误在几十场里反复出现。
边界:齐套校验不能替代导演判断
齐套校验能拦住“没带图”“绑错图”“图不可读”的问题,但它不能替创作者判断镜头好不好、表演是否到位、节奏是否成立。它也不是强制门禁:缺图时系统可以提醒,但创作者仍可选择跳过,走纯文字路径。只是这种选择应是明确的,而不是在不知情下硬拍。
此外,约 10 秒一个场块是工程启发式,不是时间码精剪;超长场可能继续拆分,但精剪、转场和串场成片仍需要后续剪辑环节。角色一致性也依赖定妆资产链路,而不是人脸嵌入校验,最终观感仍取决于立绘质量和提示词是否遵守“有图不写外观”。
在猫斯卡的流程里,开拍前会按场检查场景、道具、人物参考是否齐全;缺项会形成清单,引导先绘制或明确跳过。它把片场里的“带齐道具、核对定妆、确认场景板”固化成可重复步骤,但镜头审美、表演取舍和最终择优仍在创作者手里。
常见问题
AI 短剧开拍前为什么一定要做资产齐套校验?
因为视频生成只认这一场实际绑定到的参考图。缺场景图、道具图或人物定妆图时,模型会根据文字临时补全,容易出现换景、道具失忆、换装和换脸。齐套校验就是在提交出片前把这些缺口拦下来。
本场参考图应该按什么顺序排列?
建议按场景图、本场道具图、人物定妆图的顺序排列。场景先建立空间,道具进入空间,人物最后在空间中行动。有图才占槽位,没有图应明确标注仅文字,不要假装已经绑定。
缺人物定妆图但文字写得很详细,可以直接拍吗?
可以走纯文字路径,但不建议作为常规做法。文字越详细,越可能和后续定妆或模型理解冲突,导致角色不稳定。专业流程应先完成定妆图;拍摄时有图的人物也不要再用文字重复描写服装和外观。
道具图是不是越多越好?
不是。本场只应绑定剧情需要的道具,无关道具应排除。道具过多会分散模型注意力,挤占参考槽位,甚至让关键证据在画面里不突出。
齐套校验通过后是不是一次就能生成成功?
不一定。齐套校验解决的是参考资产是否齐全、正确、可读的问题,不能保证复杂动作、多人互动或强烈运镜一次成功。关键场仍应通过多 take、改词和换图重拍来择优。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com