画面不是拍下来的,是算出来的。 这一条差别,会引出你在这里遇到的几乎所有「怎么会这样」。
四件跟拍摄完全不同的事
一、同样的要求,每次给的结果都不一样。 真实拍摄里,同一个演员站在同一个地方,拍十条都是同一个人。AI 不是——它每次都从头算一遍。所以同一段描述重新生成,出来的会是另一版。这不是出错,是它的工作方式。满意的东西要留住,别随手重做。
二、不能只改一小块。 你不能说「把第 3 秒她的表情改一下,其他不动」。改任何一处都要整段重新算,出来的就是全新的一段。所以我们的做法是先把该定的定住(人物设定图、场景图),再生成——地基定死了,重算才不会面目全非。
三、一次只能出几秒。 目前最长一次 30 秒。一集一两分钟的片子,必须切成很多小段分别生成,最后接起来。这就是剧本要分场、场要分镜头的原因。
四、有内容审核,而且不是我们在审。 生成图片和视频的是第三方 AI 服务商,它们有自己的内容安全规则。有些描述会在开始生成前就被拦下,有些是画出来了但成品没放行。猫斯卡没法代为放行,只能换个写法重试。被拦不扣积分。
所以流程才是这个样子
理解了上面四条,你就会明白为什么不是「输入故事,等着出片」:
| 你看到的步骤 | 真正在解决的问题 |
|---|---|
| 先写剧本、再分场 | 把片子切成 AI 一次算得动的小段 |
| 先画人物设定图 | 锁住长相,不然每段里的人都不是同一个 |
| 先画场景图 | 锁住地点,不然同一个客厅每次都变样 |
| 一场场生成、单独重拍 | 不满意只重算这一段,不用整集推倒 |
一个心态上的提醒
它不是许愿机,更像一个手很快但记性不好的画师。 你说得越具体,它画得越准;你把参考图递给它,它就照着画。反过来,指望一句「拍得好看点」就出好片,多半会失望。
下一步
接着看「为什么剧本要分那么多场」,那是这套流程的第一块基石。