English

AI 漫剧制作实操手册:把一句话想法做成竖屏成片的片场流程

猫斯卡编辑部 | 最后更新日期

做 AI 漫剧,关键不是找一个“生成按钮”,而是把创意、剧本、角色、画风、分镜和出片拆成可验收环节。每一步先确认,再进入下一步,才能稳定做成竖屏成片。

先明确:AI 漫剧到底是什么

AI 漫剧是用 AI 生产链制作的动画形态竖屏短剧。它可以是 2D 动画,也可以是 3D 动画;与真人写实短剧的差别主要在画风选择,而不是另起一套完全不同的生产方法。

更准确地说,AI 漫剧制作是把传统短剧开发里的立项、编剧、美术、定妆、分镜、拍摄和选片,改造成一条有中间产物、可回看、可返工的流水线。

它不适合只想输入一句话、完全不审片就拿到稳定成片的人。审美判断、角色取舍、剧情方向和最终选片仍然需要人来做。

第一步:把一句话想法变成可立项的创意

一句话想法通常只有题材和主角,例如“落魄千金回到家族宴会”“废柴徒弟其实是魔尊”。这类句子能提供方向,但还不能直接开拍。

进入制作前,至少要补齐十个维度:

  1. 题材:都市逆袭、古风虐恋、仙侠复仇、甜宠、悬疑等。
  2. 主角:身份、欲望、弱点和人物弧光。
  3. 核心矛盾:谁阻止主角,主角失去什么。
  4. 故事走向:开局处境、中段升级、后段反转。
  5. 集数:准备做单季、短篇,还是连续更新。
  6. 单集时长:竖屏短剧通常以 1–2 分钟为主,最长可收敛到 3–4 分钟。
  7. 风格基调:爽感、虐感、轻喜、悬疑、治愈等。
  8. 爽点与钩子节奏:多久给一次反转、打脸或身份暗示。
  9. 结局方向:复仇完成、情感圆满、开放式悬念等。
  10. 投放平台与受众:平台节奏、观众年龄层和观看场景。

如果初始信息很完整,可以直接进入创意简报;信息不完整,就应先补缺失维度。这样做的目的不是增加表格,而是避免写到十几集后发现主角动机、题材尺度或平台节奏不对。

第二步:锁版创意简报,再进入编剧

创意简报相当于立项会结束后的 Brief。它必须在进入剧本前锁定,后续角色、分集和美术都围绕它展开。

一份可执行的漫剧简报通常包含:

模块要确认的内容
一句话故事主角、目标、阻碍和最大看点
核心矛盾主线冲突是谁和谁的冲突
故事走向开局、发展、反转、结局的大致路径
人物弧光主角从什么状态变成什么状态
爽点节奏小爽点、大爽点、身份揭露如何分布
钩子设计每集结尾用什么悬念逼观众点下一集
平台受众面向哪类观众,节奏偏快还是偏情绪
分集梗概每集承担什么剧情功能
编剧注意事项不能改的设定、题材边界和风格要求

这里最容易被忽略的是人物弧光。很多 AI 短剧只有“事件连续发生”,主角却没有变化;到了中段就只能靠误会和争吵拖时长。立项时写清人物弧光,后面的剧情才有方向。

第三步:建立角色阵容和故事档案

简报锁版后,不要急着写正文,应先确认角色阵容。至少要检查四件事:

  • 主要角色是否齐全;
  • 姓名是否清楚、合法、便于后续识别;
  • 视觉字段是否完整;
  • 主角设定是否与简报一致。

角色确认后,需要建立故事档案。故事档案是一份贯穿全剧的结构化设定记录,包含人物身份、稳定性格、当前状态、人物关系、伏线状态、按集出场表、分批剧情纪要和道具视觉描述。它相当于传统编剧室里的 continuity bible。

漫剧集数一多,最容易出现三类问题:

  1. 主角性格前后不一;
  2. 上几集埋下的证据、身份或伤势没人记得;
  3. 配角突然消失,关系线没有收束。

解决方式不是指望模型“记住”,而是每批写完后回填档案,续写前只调取与当前批次有关的人物状态、未结伏线、近期剧情纪要和本批主线。

第四步:分批写剧本,先出场戏清单

AI 漫剧剧本不建议一次性把全剧正文写完。更稳的做法是分批写作,每批数集;一批写完、归档确认,再写下一批。

每一集都应先规划,再写正文:

  1. 先出场戏清单;
  2. 标明这一集的核心冲突;
  3. 确定集末悬念;
  4. 再写每一场的动作和对白;
  5. 写完后做规则质检;
  6. 把新增人物、伏线、道具和剧情纪要回填档案。

竖屏漫剧剧本可以直接采用以下结构:

位置作用写法
第 1 场黄金 3 秒钩子强冲突、强悬念或强结果,不做背景铺垫
中段场次矛盾升级让主角选择、失去、反击或暴露新信息
每集中段小爽点打脸、反转、证据到手、身份暗示
最后 1 场集末 cliffhanger新人物登场、秘密被看见、危机压到眼前

台词要短,单句一般不超过 20 字。漫剧虽然是动画形态,但竖屏观众的阅读和听感节奏仍然接近短剧:论文腔、大段旁白、角色替观众解释前情,都会让节奏变慢。

剧本自检清单

  • 第 1 场是否直接进入冲突或悬念?
  • 本集是否有明确的剧情推进,而不是重复争吵?
  • 是否至少有一次小爽点或信息奖励?
  • 最后一场是否能自然引出下一集?
  • 角色称呼是否统一?
  • 新增道具、伤势、身份变化是否进入档案?
  • 是否存在“未完待续”等占位式敷衍?

从第二批开始,写之前还应先锁定本批剧情方向、重点人物、伏笔与冲突、集末钩子。它们属于已经确认的创作硬约束;当旧档案与新的创作意图冲突时,应以明确的创作意图为准。

第五步:选择漫剧画风,统一人物、场景和视频语言

剧本方向稳定后,再选画风。不要在角色长相还没确认时频繁切换画风,否则人物立绘、场景气质和视频风格会互相打架。

常见的 AI 漫剧画风包括:

  • 成熟都市言情动画;
  • 九十年代日漫;
  • 国风工笔;
  • 仙侠古风;
  • 3D 国漫;
  • 黏土定格;
  • 赛博国风;
  • 其他 2D、3D 或风格化动画方向。

系统内可选的画风手册覆盖 2D、3D、真人写实等方向。对漫剧制作来说,应选择 2D 或 3D 动画类画风;如果选择真人写实画风,同一条生产链产出的就是真人风格短剧。

一套画风至少要统一三件事:

  1. 人物出图方式:面容锚点、材质、气质和多视图一致性;
  2. 场景与道具画法:线条、色彩、材质和空间气质;
  3. 视频风格标签:镜头生成时继承同一视觉路径。

画风手册管的是“怎么画”,不是替用户决定“能不能出现某个剧情元素”。当剧本内容与画风手册里的世界观倾向冲突时,应优先尊重用户和剧本的明确描述。

第六步:做人、景、器定妆,不拿半成品开拍

漫剧的角色一致性,核心靠定妆资产,而不是靠每次生成时碰运气。

人物立绘建议采用两段式工艺:

  1. 先把故事档案里的人物描述,结合所选画风润色成可出图的视觉描述;
  2. 再生成定妆图,并保留为可回看、可替换的历史版本。

人物的性别属于硬规则,不应随着模型发挥而改变。视觉描述可以人工调整,因为角色气质、年龄感、服饰细节最终仍应由创作者判断。

除了人物,还要准备:

  • 场景立绘:如宴会厅、医院走廊、宗门大殿、现代公寓;
  • 道具立绘:如玉佩、合同、手机、法器、病历、戒指;
  • 特殊造型:穿越、闪回、伪装、受伤或身份阶段变化。

场景图要遵守空镜纪律:场景立绘里不应出现人物。否则后续人物站位、比例和服装都可能被场景图里的路人干扰。

道具最好按集提取,并使用剧本里的原始称呼。比如剧本写“半块龙凤佩”,就不要在视觉资产里随意改成“古玉吊坠”,否则后续检索和绑定容易混乱。

第七步:把每集切成约 10 秒的视频场块

剧本不能直接按“一整集”去生成视频。稳定做法是把每集切成多个视频场块,目标粒度约 10 秒一场。

场块相当于剪辑台上的 clip 列表:

  • 第 3 集不是一个大视频;
  • 而是场 1、场 2、场 3……
  • 每场有独立剧本内容、参考图、镜头提示词、成片和历史 takes。

正文过长时,应按动作节拍、空段和句号继续拆。群演和泛指角色不要混进主演定妆名单,否则会挤占参考槽位,也容易让主要角色形象漂移。

例如,下面这种内容就适合拆成两个场块:

  1. 女主推门进入宴会厅,众人回头嘲笑;
  2. 女主抬手展示合同,男主在人群后方认出她。

第一场负责入场压力,第二场负责反击和身份钩子。合成一条长提示词同时生成,动作越多,越容易出现表情崩坏、服装变化和镜头失控。

第八步:给每场绑定参考图

每场开拍前,应构建本场参考素材表。稳定顺序是:

  1. 场景图;
  2. 本场道具图;
  3. 人物定妆图。

有图才占槽位;没有图的内容应标明仅文字,不应假装已经绑定。每场可以绑定多张参考图,并按上述顺序占位,具体数量存在上限。

最重要的一条规则是:有参考图的人物,禁止再用文字描写服装和外观;以参考图为准,文字只写动作、表情和伤情。

这是 AI 漫剧避免换装、换脸的关键。错误写法是同时给系统一张“红裙黑发女主”的定妆图,又在提示词里写“她穿着白色长裙、金发披肩”。模型收到互相冲突的信息,就会重新解释角色。

常见参考图问题怎么处理

问题处理方式
剧本称呼和档案姓名不一致手动绑定角色,如“警官”绑定到“李强”
无关道具干扰画面将该道具从本场参考中排除
定妆图有多个历史版本选择最适合本场的一张
穿越或闪回有不同造型按场景时代和地点优先匹配对应造型
缺少场景或道具图先补图,也可有意跳过纯文字生成

缺图时系统可以提醒,但参考图不是强制门禁。创作者可以跳过走纯文字路径;只是通常一致性更难保证,所以专业流程应尽量先定妆、再开拍。

第九步:先画分镜,再写镜头提示词

如果一场戏包含多人互动、明显调度或关键情绪转折,建议先画分镜图。

分镜图是一张灰阶铅笔线稿宫格。分镜师会阅读本场剧本,同时参考人物设定图和场景图,根据这一场的节拍决定 4 格、6 格或 9 格,不为了凑格式硬填满。

分镜阶段要完成四件事:

  1. 按场景图确定床、柜、窗、门等空间位置;
  2. 把剧本里有、场景图里没有的关键物件补进去;
  3. 确定同框人物的高矮和站位;
  4. 输出一张分镜图和一份镜头清单。

镜头清单应一格一行,写清景别、机位、画面内容、台词和这一格结束时的终态。终态很重要,因为它能限制相邻镜头之间的人物位置和动作衔接。

如果对某一格不满意,不需要整张作废,可以框出那一格,用一句话说明要改什么,只重画局部。也可以保留多套分镜,最后选择最适合表演和节奏的一套。

第十步:按分镜表语言写视频提示词

视频提示词不是小说描写,也不是把剧本复制进去。它应该使用分镜表语言,让模型知道“谁在什么环境里,以什么景别和运镜,完成什么动作,最后停在哪里”。

工程化镜头提示词通常包含八大要素:

  1. 精准主体;
  2. 动作细节;
  3. 场景环境;
  4. 光影色调;
  5. 镜头运镜;
  6. 视觉风格;
  7. 画质;
  8. 约束条件。

简单场景可以一段写完;复杂影视化场景适合三段式:

  • 总体设定;
  • 镜头 1、镜头 2、镜头 3;
  • 统一约束包。

写提示词时要遵守几条硬纪律:

  • 一个镜头只安排一种主要运镜,不把推、拉、摇、移叠在一起;
  • 用镜头序号,不写“0–3 秒”这类绝对秒数;
  • 动作要低缓、连续、可执行,减少高爆发动作;
  • 多人场景加入防双胞胎、防分身约束;
  • 非写实画风要持续锚定风格;
  • 台词、音效和音乐符号要区分;
  • 只使用本场素材,不把别的场次角色和道具串进来。

台词、音效和 BGM 可以分别使用 {}、<>、() 标记。这样在后续人工审稿时,更容易确认哪些内容是角色说话,哪些是声音设计。

第十一步:选择竖屏规格并提交出片

漫剧默认应按 9:16 竖屏交付,而不是先生成横屏再事后裁切。竖屏构图会影响人物站位、景别和镜头运动,尤其是近景表情、双人对峙和手机端观看体验。

常见输出设置包括:

设置项可选思路
画幅默认 9:16,也可按需求选择其他比例
时长智能时长或固定 5–15 秒
模型档位标准、高速、轻量,按质量、成本、速度权衡
分辨率按所选模型支持范围确定
音频可按需要生成,水印默认关闭

提交前应人工阅读提示词。尤其要检查:

  • 本场角色是否绑定正确;
  • 有参考图的人物是否还被多余描写外观;
  • 道具是否真的需要出现;
  • 运镜是否过于复杂;
  • 台词和动作是否能在时长内完成;
  • 是否误带了其他场的剧情。

确认后再提交。出片时应使用已经确认或编辑过的提示词,以及当时锁定的参考图映射;只有改了词、换了图或调整设置,才构成新的拍摄选择。

第十二步:审片、重拍和多 take 择优

AI 漫剧不会每次都一次成功。专业做法不是看到一条瑕疵片就推翻全流程,而是围绕同一场保留多个 take,根据表演、动作、表情、构图和连贯性择优。

审片时建议按五个维度判断:

维度重点
角色脸、发型、服装、体型是否稳定
动作是否连续,有无肢体粘连、瞬移
表情是否符合台词和情绪
镜头景别、运镜、停顿是否清楚
连贯性与前后场的位置、伤情、道具是否接得上

如果不满意,可以按问题类型返工:

  • 角色外观漂移:检查定妆图和提示词里是否有冲突描述;
  • 道具错误:调整道具纳入或排除;
  • 动作崩坏:降低动作幅度,拆成更多场块;
  • 情绪不对:改写动作和表情,不只改形容词;
  • 镜头混乱:减少运镜,回到分镜图和镜头序号;
  • 画风不统一:检查人物、场景、视频是否共用同一画风路径。

需要强调的是,目前没有成片自动打分或自动择优重拍引擎。系统可以提供多 take、改词、换图和重拍工具,但质量终审仍在创作者和监制手里。

剧本改了,下游怎么处理

漫剧制作中,改剧本很正常。关键是不要让旧角色图、旧道具和旧成片悄悄混在新版本里。

当某一集正文保存或重写后,应按集检查受影响的下游内容:

  • 本场出场人物是否需要重新确认;
  • 新道具是否需要补设定图;
  • 新场景是否需要补场景图;
  • 分镜是否需要按新正文重切;
  • 已经生成的旧成片是否保留或重拍;
  • 人物设定和故事档案是否需要人工复核。

更合理的机制是:勾中的下游项目才重做、才计费;分镜按新正文重新切分不应额外收费;旧成片如果来自旧版正文,应明确标记,是否重拍由创作者决定。

成片后的裁剪、合并与配音

单场出片后,不必立刻搬到外部软件做所有处理。常见后期动作包括:

  • 在播放器里设置入点和出点,逐帧步进;
  • 裁剪后预览首帧和末帧;
  • 将一集里的多场成片按顺序合并;
  • 场与场之间使用叠化,片头淡入、片尾淡出;
  • 对没有出片的场次给出提示,而不是静默跳过;
  • 逐角色设置配音语言和口音。

配音语言和口音应按角色保存,并在全剧生效;它改变的是口条和声音呈现,不应改动剧本里的台词文字。

约 10 秒的场块是工程启发式,不是时间码精剪。个别场次仍可能偏长,站内可以完成裁剪和整集合并,但更复杂的调色、声音设计和精细剪辑,仍应交给专业剪辑软件。

一条可直接执行的 AI 漫剧流程

如果把上面的内容压缩成实操顺序,可以按这张清单执行:

  1. 写清一句话想法;
  2. 补齐题材、主角、矛盾、走向、集数、时长、基调、爽点、结局和受众;
  3. 锁版创意简报;
  4. 确认角色阵容;
  5. 建立故事档案;
  6. 每集先出场戏清单和集末悬念;
  7. 分批写正文;
  8. 做剧本规则质检并回填档案;
  9. 选择 2D 或 3D 漫剧画风;
  10. 制作人物、场景、道具定妆图;
  11. 把每集切成约 10 秒场块;
  12. 给每场绑定场景、道具和人物参考图;
  13. 关键场绘制宫格分镜;
  14. 按分镜生成镜头提示词;
  15. 人工审词并调整;
  16. 选择 9:16、时长、档位和分辨率;
  17. 提交出片并保留多个 take;
  18. 改词、换图、重拍,择优进入整集合并。

这套流程的价值在于,每个环节都有可验收的中间产物:简报、角色、档案、剧本、定妆图、场块、分镜、提示词和成片。它们可以看、可以改、可以回退,而不是把所有风险压到最后一次生成上。

猫斯卡固化了哪些环节

猫斯卡是 AI 竖屏短剧生产操作系统。它没有试图用一次生成替代剧组,而是把短剧工业里已经被验证的质量顺序固化下来:先故事与连续性,再定妆,再分场,再镜头指令,再多 take 择优。

在漫剧制作中,猫斯卡覆盖从创意评估、简报锁版、故事档案、分批剧本、画风选择、人景器定妆、约 10 秒场块、宫格分镜、镜头提示词到竖屏出片和返工的完整链路。系统内有 18 位数字专家,按真实剧组工种分工,创作者可以看到流式工作记录,而不是面对黑箱。

但它也有明确边界:

  • 不会替创作者自动判断哪条成片一定最好;
  • 缺少参考图时可以提醒,但不能强迫补图;
  • 不做跨场自动编排,续写和延长都需要创作者显式发起;
  • 角色一致性依赖定妆资产和规范提示词,不是人脸嵌入校验;
  • 更精细的剪辑、调色和声音设计仍可能需要外部专业软件。

猫斯卡适合需要持续产出、重视角色一致性和流程可控的漫剧团队;不适合希望完全不审片、不做设定、不接受返工,却要求稳定高质量成片的用法。

常见问题

AI 漫剧和真人短剧在制作上有什么区别?

主要区别在画风。选择 2D 或 3D 动画画风就是漫剧,选择真人写实画风就是真人风格短剧。两者可以共用创意、剧本、故事档案、分场、分镜和出片这条生产链。

一句话真的能做成 AI 漫剧吗?

一句话可以作为创意起点,但不能直接稳定产出成片。还需要补齐主角、核心矛盾、故事走向、集数、时长、爽点、结局和受众,再锁创意简报、写剧本、做定妆和分镜。

AI 漫剧怎么防止角色换脸、换装?

先制作角色定妆图,每场按场景、道具、人物的顺序绑定参考图。有参考图的人物不要再用文字描写服装和外观,文字只写动作、表情和伤情,并在出片前检查是否有冲突描述。

AI 漫剧一场做多长比较合适?

建议把剧本切成约 10 秒一个视频场块,通常可控制在 5–15 秒。动作越多、人物越多,越应拆细,不要用一条长提示词完成复杂调度。

剧本改了,已经画好的图和拍好的视频怎么办?

应按集检查受影响的人物、场景、道具、分镜和成片。需要重做的下游项目逐项确认,旧成片应保留并标记是否来自旧版正文,是否重拍由创作者决定。

AI 漫剧能不能完全自动出成片?

不能把质量寄托在完全自动上。系统可以固化流程、生成资产和提供多 take,但剧情方向、审美判断、提示词审核和最终选片仍需要人来完成。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com