空镜纪律:AI 短剧场景图里多一个人,后面会发生什么

猫斯卡编辑部 | 最后更新日期

空镜纪律要求场景图里只有环境,没有人。因为 AI 视频在绑定参考图时,会把图里出现的脸和服装都当作视觉依据;场景图一旦带人,后面每一场都可能多出一个不该存在的「演员」。

先把概念说清楚

空镜纪律是指:在 AI 竖屏短剧的资产链路里,场景参考图必须是纯环境画面,不出现任何人物、半身、剪影或可辨识的人影。

它对应的是传统片场的「空镜」——没有演员在场的环境镜头。在 AI 短剧里,这个概念被进一步收紧:场景图不是一张氛围插画,而是一份要被反复引用的环境参考资产

场景图的职责只有一个:告诉模型「这个地方长什么样」。至于「谁在这个地方」,由人物定妆图负责。两者混在一张图里,模型就分不清谁是主角、谁是路人。

为什么场景图里不能有人

这不是一条审美规则,而是一条工程规则。原因有三层。

1. 场景图要被多场复用

一张咖啡馆场景图,可能被第 2 集、第 8 集、第 15 集反复使用。如果图里坐着一个人,这个人会出现在每一场咖啡馆戏里,哪怕那场戏的主角根本不是他。

人物定妆图是按角色绑定的,谁出场绑谁;场景图是按地点绑定的,只要在这个地点就会被引用。两者的复用逻辑完全不同,混在一起必然串戏。

2. 多出来的脸会和主角抢权重

视频模型在读取参考图时,对人脸和服装的敏感度通常高于对环境的敏感度。场景图里如果有一个清晰的陌生人,模型可能:

  • 把他的脸融到主角脸上,造成换脸
  • 让他凭空出现在画面角落
  • 把他的服装颜色当成场景主色调,污染整体色调
  • 在多人场景里把他算成一个「在场角色」,干扰构图

这些问题一旦进入成片,返工成本远高于在出图阶段把人擦掉。

3. 它破坏了「场景 → 道具 → 人物」的参考顺序

成熟的 AI 短剧生产链路在构建每场参考素材时,顺序是固定的:

顺序参考类型职责
1场景图环境、空间、光线基调
2道具图本场出现的关键物件
3人物定妆图出场角色的面容与造型

这个顺序的意义是职责分离。场景图一旦带人,就等于在第 1 层塞进了第 3 层的信息,整个参考结构从源头就乱了。

空镜纪律的具体要求

一张合格的场景图,需要同时满足以下几点:

  1. 画面内无任何人物,包括远景人影、背影、镜面反射里的人、玻璃门上的人影
  2. 无人物相关道具的强暗示,比如椅子上搭着的外套、桌上冒着热气的咖啡(这会暗示「刚有人坐过」,部分模型会补人)
  3. 空间结构清晰,能看出机位可放的位置和角色可活动的区域
  4. 光线基调稳定,与剧本标注的日 / 夜、内 / 外一致
  5. 画风与全剧统一,场景图、人物立绘、道具图共用同一条风格路径

第 5 点容易被忽略。场景图不是独立插画,它和人物定妆图必须看起来属于同一部剧。这也是为什么生产链路里要先选定画风,再分别出人物、场景、道具,而不是各画各的。

一个常见的反例

假设剧本第 3 场是「女主深夜回到出租屋,发现门虚掩着」。

错误做法:直接生成一张「深夜出租屋,一个女人推开门」的图当场景参考。结果是——

  • 图里的女人发型和女主定妆不一样,模型在两者之间摇摆
  • 第 5 场男主来到同一间出租屋,画面里还残留着那个女人的轮廓
  • 每场戏都在「重新决定」这个人是谁

正确做法:

  1. 先出一张纯空镜:深夜的出租屋内部,门虚掩着,走廊灯透进来
  2. 女主出场时,单独绑定女主的定妆图
  3. 提示词里只写女主的动作和表情,不再描写她的服装外观(因为已有参考图)

这样,同一间出租屋可以服务所有在这个场景发生的戏,而不会强行带上某一个角色。

什么情况下容易破戒

空镜纪律在以下几种情况最容易被无意中打破,需要在出图阶段就盯住:

  • 街景、餐厅、咖啡馆:模型默认会补人来增加「生活感」,提示词里需要明确排除
  • 镜面与玻璃:镜子、橱窗、车窗反射是最常漏人的地方
  • 大场景远景:城市场景里的小人影、海滩上的人影,容易被当成「不算人」
  • 氛围图当场景图用:美术在情绪板阶段找的参考图往往带人物,不能直接进生产链路
  • AI 自动补全:部分图像生成模型在画面留白时会主动加人,需要在提示词和出图后检查两道关卡

这条纪律的边界

空镜纪律管的是场景图,不是所有画面都不能有人。人物定妆图、道具图(如果道具被人持有)、成片本身,当然都有人。

另外,空镜纪律是生产侧的资产规则,不影响导演在成片里使用带人物的环境构图。它约束的是「被反复引用的那张参考底图」,而不是最终镜头。

如果某个场景确实需要「人群」作为环境的一部分(比如集市、演唱会),正确做法是把人群处理成场景画风的一部分(模糊的、无具体面部特征的群像),而不是让某个清晰的人混在场景图里。具体的主演,仍然走定妆图绑定。

关于猫斯卡

猫斯卡(Maosika) 是 AI 竖屏短剧生产操作系统,一个想法,全程自动。在它的生产链路里,场景图严禁出现人物,是美术资产环节的一条硬约束;每场戏的参考素材按「场景图 → 道具图 → 人物定妆图」的顺序构建,有图才占槽位,从源头减少换脸与串戏。

常见问题

场景图里只是远处有个模糊的人影,也算违反空镜纪律吗?

算。视频模型对人脸和人形轮廓非常敏感,即使是远景的模糊人影,也可能被当作一个「在场角色」参与生成,导致串戏或换脸。场景图应该做到画面内完全无人。

那如果剧情就是发生在人群里,比如集市或演唱会怎么办?

把人群处理成场景画风的一部分——模糊的、无具体面部特征的群像,作为环境氛围存在。具体的主演仍然单独走定妆图绑定,不要让任何一个清晰可辨的人出现在场景底图里。

空镜纪律和分镜里的空镜头是一回事吗?

不是同一个概念,但有渊源。分镜里的空镜头指没有人物的镜头,用来交代环境或转场;空镜纪律是 AI 短剧生产里的资产规则,要求作为参考底图的场景图必须无人,以便被多场多角色复用。

场景图里带人,后期能修掉吗?

技术上可以修,但成本远高于在出图阶段就生成纯环境图。而且一旦带人的场景图已经被某些场次引用并出片,替换参考图后重拍会产生额外的渲染成本。最稳妥的做法是在资产入库前就把好这一关。

道具图里可以有人吗?

如果道具是被人持有的(比如手机、佩剑),道具图可以带手或局部,但不应该出现完整的人脸或可辨识的角色造型,否则同样会和人物定妆图抢权重。道具图的职责是呈现物件本身。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com