空镜纪律:AI 短剧场景图为什么必须先于人物存在
空镜纪律指的是:AI 短剧里用于绑定场次的场景参考图,必须是一张没有人的环境图。原因很简单——场景图一旦带人,模型就会把图里那个人当作本场角色的视觉锚点,和你真正的定妆图打架。
先把概念说清楚
空镜纪律是 AI 短剧制作中的一条美术约束:用于场次绑定的场景参考图,只能呈现环境、空间、光线、陈设与氛围,不得出现任何人物——包括背影、剪影、倒影、局部肢体,以及看起来像人的人形物。
它对应传统片场的「空镜」概念:摄影机在演员到场之前或离场之后,单独拍一条只有环境的镜头。在 AI 短剧流程里,这条纪律被前移到了出图阶段,并且是硬规则而不是建议。
为什么这件事在 AI 短剧里特别致命
在真人剧组里,空镜是锦上添花;在 AI 短剧里,空镜是生产前提。原因在于 AI 视频模型处理参考图的方式:它不会区分「这张图里的人是主角」还是「这张图里的人只是路过的氛围元素」。只要场景图里出现了人形,模型就有概率把它当作角色外观的一部分去继承。
具体会出现三类翻车:
| 翻车类型 | 表现 | 根因 |
|---|---|---|
| 串脸 | 主角长成了场景图里路人的脸 | 场景图里的人脸被当作面部锚点 |
| 换装 | 主角穿着场景图里人物的衣服出场 | 服装信息被环境图覆盖 |
| 多余人影 | 镜头里凭空多出一个人站在角落 | 模型把图里的人形当作「应当在场的角色」 |
这三类问题在成片阶段几乎无法靠改提示词挽救,因为参考图的视觉权重通常高于文字描述。唯一可靠的解法是从源头让场景图里没有人。
场景图、道具图、人物定妆图:三层参考各司其职
理解空镜纪律的最好方式,是看清单场戏的参考图是怎么分层的。在一条成熟的 AI 短剧生产链里,每场戏会按固定顺序构建一张参考素材表:
- 场景图——回答「故事发生在什么地方」
- 道具图——回答「这一场有哪些关键物件」
- 人物定妆图——回答「出场的人长什么样、穿什么」
三层之间不能越界。场景图管空间,不管人;道具图管物件,不管人穿什么;人物定妆图管外观,不管他站在哪个房间。一旦某一层夹带了另一层的信息,模型就会收到冲突指令。
这也是为什么专业流程会配套一条更高优先级的约束:有参考图的人物,禁止再用文字描写服装和外观,以参考图为准,文字只写动作、表情、伤情。 场景图里如果有人,等于在这条约束之外偷偷塞进了第四套外观描述,质检再严也兜不住。
空镜纪律怎么落地
知道规则是一回事,在批量生产里执行是另一回事。一套能跑起来的执行机制通常包含四个动作:
- 出图阶段就约束:场景图的生成提示词里明确排除人物、人形、剪影、倒影,并在风格手册里写死。
- 入库阶段做检查:场景图进入素材库前过一遍是否含人,含人则不允许标记为「可用于场次绑定」。
- 绑定阶段只消费合格图:视频链路只读取状态为已完成且通过空镜校验的场景图,半成品和带人的图不进入参考槽位。
- 手动替换通道:如果某场戏确实需要「有人的环境氛围」,那是一张独立的氛围参考图,而不是场景主图;创作者可以手动管理,不占用场景槽位。
需要特别说清楚的是:空镜纪律不等于「画面里不能有人」。成片里当然有人,有人的是镜头,不是场景参考图。这两者的区别,是业余做法和工业化做法的分水岭。
什么情况下这条纪律会被误读
有三种常见质疑,值得逐一回应。
「我这场戏就是要在人群里,场景图不带人不真实。」 人群属于演出调度,由分镜和提示词在拍摄阶段描述,不应该烤进场景图。场景图提供的是「这条街」,提示词负责「这条街上有多少人、在做什么」。
「我画的是背影,又看不到脸,应该没事吧。」 背影同样携带服装、发型、体态信息,模型照样会继承。剪影和倒影同理。
「我故意在场景里放一个人做比例参考。」 这是建筑效果图的做法,不是 AI 短剧的做法。比例参考应该用道具(家具、门、车辆)来建立,而不是人。
边界与诚实说明
空镜纪律能解决的是「场景图污染人物外观」这一类问题,它不是万能的。角色一致性最终还依赖定妆图本身的质量、提示词是否遵守「有图不写外观」、以及模型档位的稳定性。把场景图清干净,只是把本该各司其职的三层参考还原到各自的位置上。
换句话说,空镜纪律不是一条让片子变好看的艺术规则,而是一条让批量生产不翻车的工程规则。它不保证你出爆款,但能保证你在拍到第 80 场的时候,主角还穿着第 1 场定妆时的那件衣服。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com