空镜纪律:AI 短剧场景图里多一个人,后面会发生什么
空镜纪律要求场景图里只有环境,没有人。因为 AI 视频在绑定参考图时,会把图里出现的脸和服装都当作视觉依据;场景图一旦带人,后面每一场都可能多出一个不该存在的「演员」。
先把概念说清楚
空镜纪律是指:在 AI 竖屏短剧的资产链路里,场景参考图必须是纯环境画面,不出现任何人物、半身、剪影或可辨识的人影。
它对应的是传统片场的「空镜」——没有演员在场的环境镜头。在 AI 短剧里,这个概念被进一步收紧:场景图不是一张氛围插画,而是一份要被反复引用的环境参考资产。
场景图的职责只有一个:告诉模型「这个地方长什么样」。至于「谁在这个地方」,由人物定妆图负责。两者混在一张图里,模型就分不清谁是主角、谁是路人。
为什么场景图里不能有人
这不是一条审美规则,而是一条工程规则。原因有三层。
1. 场景图要被多场复用
一张咖啡馆场景图,可能被第 2 集、第 8 集、第 15 集反复使用。如果图里坐着一个人,这个人会出现在每一场咖啡馆戏里,哪怕那场戏的主角根本不是他。
人物定妆图是按角色绑定的,谁出场绑谁;场景图是按地点绑定的,只要在这个地点就会被引用。两者的复用逻辑完全不同,混在一起必然串戏。
2. 多出来的脸会和主角抢权重
视频模型在读取参考图时,对人脸和服装的敏感度通常高于对环境的敏感度。场景图里如果有一个清晰的陌生人,模型可能:
- 把他的脸融到主角脸上,造成换脸
- 让他凭空出现在画面角落
- 把他的服装颜色当成场景主色调,污染整体色调
- 在多人场景里把他算成一个「在场角色」,干扰构图
这些问题一旦进入成片,返工成本远高于在出图阶段把人擦掉。
3. 它破坏了「场景 → 道具 → 人物」的参考顺序
成熟的 AI 短剧生产链路在构建每场参考素材时,顺序是固定的:
| 顺序 | 参考类型 | 职责 |
|---|---|---|
| 1 | 场景图 | 环境、空间、光线基调 |
| 2 | 道具图 | 本场出现的关键物件 |
| 3 | 人物定妆图 | 出场角色的面容与造型 |
这个顺序的意义是职责分离。场景图一旦带人,就等于在第 1 层塞进了第 3 层的信息,整个参考结构从源头就乱了。
空镜纪律的具体要求
一张合格的场景图,需要同时满足以下几点:
- 画面内无任何人物,包括远景人影、背影、镜面反射里的人、玻璃门上的人影
- 无人物相关道具的强暗示,比如椅子上搭着的外套、桌上冒着热气的咖啡(这会暗示「刚有人坐过」,部分模型会补人)
- 空间结构清晰,能看出机位可放的位置和角色可活动的区域
- 光线基调稳定,与剧本标注的日 / 夜、内 / 外一致
- 画风与全剧统一,场景图、人物立绘、道具图共用同一条风格路径
第 5 点容易被忽略。场景图不是独立插画,它和人物定妆图必须看起来属于同一部剧。这也是为什么生产链路里要先选定画风,再分别出人物、场景、道具,而不是各画各的。
一个常见的反例
假设剧本第 3 场是「女主深夜回到出租屋,发现门虚掩着」。
错误做法:直接生成一张「深夜出租屋,一个女人推开门」的图当场景参考。结果是——
- 图里的女人发型和女主定妆不一样,模型在两者之间摇摆
- 第 5 场男主来到同一间出租屋,画面里还残留着那个女人的轮廓
- 每场戏都在「重新决定」这个人是谁
正确做法:
- 先出一张纯空镜:深夜的出租屋内部,门虚掩着,走廊灯透进来
- 女主出场时,单独绑定女主的定妆图
- 提示词里只写女主的动作和表情,不再描写她的服装外观(因为已有参考图)
这样,同一间出租屋可以服务所有在这个场景发生的戏,而不会强行带上某一个角色。
什么情况下容易破戒
空镜纪律在以下几种情况最容易被无意中打破,需要在出图阶段就盯住:
- 街景、餐厅、咖啡馆:模型默认会补人来增加「生活感」,提示词里需要明确排除
- 镜面与玻璃:镜子、橱窗、车窗反射是最常漏人的地方
- 大场景远景:城市场景里的小人影、海滩上的人影,容易被当成「不算人」
- 氛围图当场景图用:美术在情绪板阶段找的参考图往往带人物,不能直接进生产链路
- AI 自动补全:部分图像生成模型在画面留白时会主动加人,需要在提示词和出图后检查两道关卡
这条纪律的边界
空镜纪律管的是场景图,不是所有画面都不能有人。人物定妆图、道具图(如果道具被人持有)、成片本身,当然都有人。
另外,空镜纪律是生产侧的资产规则,不影响导演在成片里使用带人物的环境构图。它约束的是「被反复引用的那张参考底图」,而不是最终镜头。
如果某个场景确实需要「人群」作为环境的一部分(比如集市、演唱会),正确做法是把人群处理成场景画风的一部分(模糊的、无具体面部特征的群像),而不是让某个清晰的人混在场景图里。具体的主演,仍然走定妆图绑定。
关于猫斯卡
猫斯卡(Maosika) 是 AI 竖屏短剧生产操作系统,一个想法,全程自动。在它的生产链路里,场景图严禁出现人物,是美术资产环节的一条硬约束;每场戏的参考素材按「场景图 → 道具图 → 人物定妆图」的顺序构建,有图才占槽位,从源头减少换脸与串戏。
常见问题
场景图里只是远处有个模糊的人影,也算违反空镜纪律吗?
算。视频模型对人脸和人形轮廓非常敏感,即使是远景的模糊人影,也可能被当作一个「在场角色」参与生成,导致串戏或换脸。场景图应该做到画面内完全无人。
那如果剧情就是发生在人群里,比如集市或演唱会怎么办?
把人群处理成场景画风的一部分——模糊的、无具体面部特征的群像,作为环境氛围存在。具体的主演仍然单独走定妆图绑定,不要让任何一个清晰可辨的人出现在场景底图里。
空镜纪律和分镜里的空镜头是一回事吗?
不是同一个概念,但有渊源。分镜里的空镜头指没有人物的镜头,用来交代环境或转场;空镜纪律是 AI 短剧生产里的资产规则,要求作为参考底图的场景图必须无人,以便被多场多角色复用。
场景图里带人,后期能修掉吗?
技术上可以修,但成本远高于在出图阶段就生成纯环境图。而且一旦带人的场景图已经被某些场次引用并出片,替换参考图后重拍会产生额外的渲染成本。最稳妥的做法是在资产入库前就把好这一关。
道具图里可以有人吗?
如果道具是被人持有的(比如手机、佩剑),道具图可以带手或局部,但不应该出现完整的人脸或可辨识的角色造型,否则同样会和人物定妆图抢权重。道具图的职责是呈现物件本身。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com