AI 漫剧制作实操手册:把一句话想法做成竖屏成片的片场流程
做 AI 漫剧,关键不是找一个“生成按钮”,而是把创意、剧本、角色、画风、分镜和出片拆成可验收环节。每一步先确认,再进入下一步,才能稳定做成竖屏成片。
先明确:AI 漫剧到底是什么
AI 漫剧是用 AI 生产链制作的动画形态竖屏短剧。它可以是 2D 动画,也可以是 3D 动画;与真人写实短剧的差别主要在画风选择,而不是另起一套完全不同的生产方法。
更准确地说,AI 漫剧制作是把传统短剧开发里的立项、编剧、美术、定妆、分镜、拍摄和选片,改造成一条有中间产物、可回看、可返工的流水线。
它不适合只想输入一句话、完全不审片就拿到稳定成片的人。审美判断、角色取舍、剧情方向和最终选片仍然需要人来做。
第一步:把一句话想法变成可立项的创意
一句话想法通常只有题材和主角,例如“落魄千金回到家族宴会”“废柴徒弟其实是魔尊”。这类句子能提供方向,但还不能直接开拍。
进入制作前,至少要补齐十个维度:
- 题材:都市逆袭、古风虐恋、仙侠复仇、甜宠、悬疑等。
- 主角:身份、欲望、弱点和人物弧光。
- 核心矛盾:谁阻止主角,主角失去什么。
- 故事走向:开局处境、中段升级、后段反转。
- 集数:准备做单季、短篇,还是连续更新。
- 单集时长:竖屏短剧通常以 1–2 分钟为主,最长可收敛到 3–4 分钟。
- 风格基调:爽感、虐感、轻喜、悬疑、治愈等。
- 爽点与钩子节奏:多久给一次反转、打脸或身份暗示。
- 结局方向:复仇完成、情感圆满、开放式悬念等。
- 投放平台与受众:平台节奏、观众年龄层和观看场景。
如果初始信息很完整,可以直接进入创意简报;信息不完整,就应先补缺失维度。这样做的目的不是增加表格,而是避免写到十几集后发现主角动机、题材尺度或平台节奏不对。
第二步:锁版创意简报,再进入编剧
创意简报相当于立项会结束后的 Brief。它必须在进入剧本前锁定,后续角色、分集和美术都围绕它展开。
一份可执行的漫剧简报通常包含:
| 模块 | 要确认的内容 |
|---|---|
| 一句话故事 | 主角、目标、阻碍和最大看点 |
| 核心矛盾 | 主线冲突是谁和谁的冲突 |
| 故事走向 | 开局、发展、反转、结局的大致路径 |
| 人物弧光 | 主角从什么状态变成什么状态 |
| 爽点节奏 | 小爽点、大爽点、身份揭露如何分布 |
| 钩子设计 | 每集结尾用什么悬念逼观众点下一集 |
| 平台受众 | 面向哪类观众,节奏偏快还是偏情绪 |
| 分集梗概 | 每集承担什么剧情功能 |
| 编剧注意事项 | 不能改的设定、题材边界和风格要求 |
这里最容易被忽略的是人物弧光。很多 AI 短剧只有“事件连续发生”,主角却没有变化;到了中段就只能靠误会和争吵拖时长。立项时写清人物弧光,后面的剧情才有方向。
第三步:建立角色阵容和故事档案
简报锁版后,不要急着写正文,应先确认角色阵容。至少要检查四件事:
- 主要角色是否齐全;
- 姓名是否清楚、合法、便于后续识别;
- 视觉字段是否完整;
- 主角设定是否与简报一致。
角色确认后,需要建立故事档案。故事档案是一份贯穿全剧的结构化设定记录,包含人物身份、稳定性格、当前状态、人物关系、伏线状态、按集出场表、分批剧情纪要和道具视觉描述。它相当于传统编剧室里的 continuity bible。
漫剧集数一多,最容易出现三类问题:
- 主角性格前后不一;
- 上几集埋下的证据、身份或伤势没人记得;
- 配角突然消失,关系线没有收束。
解决方式不是指望模型“记住”,而是每批写完后回填档案,续写前只调取与当前批次有关的人物状态、未结伏线、近期剧情纪要和本批主线。
第四步:分批写剧本,先出场戏清单
AI 漫剧剧本不建议一次性把全剧正文写完。更稳的做法是分批写作,每批数集;一批写完、归档确认,再写下一批。
每一集都应先规划,再写正文:
- 先出场戏清单;
- 标明这一集的核心冲突;
- 确定集末悬念;
- 再写每一场的动作和对白;
- 写完后做规则质检;
- 把新增人物、伏线、道具和剧情纪要回填档案。
竖屏漫剧剧本可以直接采用以下结构:
| 位置 | 作用 | 写法 |
|---|---|---|
| 第 1 场 | 黄金 3 秒钩子 | 强冲突、强悬念或强结果,不做背景铺垫 |
| 中段场次 | 矛盾升级 | 让主角选择、失去、反击或暴露新信息 |
| 每集中段 | 小爽点 | 打脸、反转、证据到手、身份暗示 |
| 最后 1 场 | 集末 cliffhanger | 新人物登场、秘密被看见、危机压到眼前 |
台词要短,单句一般不超过 20 字。漫剧虽然是动画形态,但竖屏观众的阅读和听感节奏仍然接近短剧:论文腔、大段旁白、角色替观众解释前情,都会让节奏变慢。
剧本自检清单
- 第 1 场是否直接进入冲突或悬念?
- 本集是否有明确的剧情推进,而不是重复争吵?
- 是否至少有一次小爽点或信息奖励?
- 最后一场是否能自然引出下一集?
- 角色称呼是否统一?
- 新增道具、伤势、身份变化是否进入档案?
- 是否存在“未完待续”等占位式敷衍?
从第二批开始,写之前还应先锁定本批剧情方向、重点人物、伏笔与冲突、集末钩子。它们属于已经确认的创作硬约束;当旧档案与新的创作意图冲突时,应以明确的创作意图为准。
第五步:选择漫剧画风,统一人物、场景和视频语言
剧本方向稳定后,再选画风。不要在角色长相还没确认时频繁切换画风,否则人物立绘、场景气质和视频风格会互相打架。
常见的 AI 漫剧画风包括:
- 成熟都市言情动画;
- 九十年代日漫;
- 国风工笔;
- 仙侠古风;
- 3D 国漫;
- 黏土定格;
- 赛博国风;
- 其他 2D、3D 或风格化动画方向。
系统内可选的画风手册覆盖 2D、3D、真人写实等方向。对漫剧制作来说,应选择 2D 或 3D 动画类画风;如果选择真人写实画风,同一条生产链产出的就是真人风格短剧。
一套画风至少要统一三件事:
- 人物出图方式:面容锚点、材质、气质和多视图一致性;
- 场景与道具画法:线条、色彩、材质和空间气质;
- 视频风格标签:镜头生成时继承同一视觉路径。
画风手册管的是“怎么画”,不是替用户决定“能不能出现某个剧情元素”。当剧本内容与画风手册里的世界观倾向冲突时,应优先尊重用户和剧本的明确描述。
第六步:做人、景、器定妆,不拿半成品开拍
漫剧的角色一致性,核心靠定妆资产,而不是靠每次生成时碰运气。
人物立绘建议采用两段式工艺:
- 先把故事档案里的人物描述,结合所选画风润色成可出图的视觉描述;
- 再生成定妆图,并保留为可回看、可替换的历史版本。
人物的性别属于硬规则,不应随着模型发挥而改变。视觉描述可以人工调整,因为角色气质、年龄感、服饰细节最终仍应由创作者判断。
除了人物,还要准备:
- 场景立绘:如宴会厅、医院走廊、宗门大殿、现代公寓;
- 道具立绘:如玉佩、合同、手机、法器、病历、戒指;
- 特殊造型:穿越、闪回、伪装、受伤或身份阶段变化。
场景图要遵守空镜纪律:场景立绘里不应出现人物。否则后续人物站位、比例和服装都可能被场景图里的路人干扰。
道具最好按集提取,并使用剧本里的原始称呼。比如剧本写“半块龙凤佩”,就不要在视觉资产里随意改成“古玉吊坠”,否则后续检索和绑定容易混乱。
第七步:把每集切成约 10 秒的视频场块
剧本不能直接按“一整集”去生成视频。稳定做法是把每集切成多个视频场块,目标粒度约 10 秒一场。
场块相当于剪辑台上的 clip 列表:
- 第 3 集不是一个大视频;
- 而是场 1、场 2、场 3……
- 每场有独立剧本内容、参考图、镜头提示词、成片和历史 takes。
正文过长时,应按动作节拍、空段和句号继续拆。群演和泛指角色不要混进主演定妆名单,否则会挤占参考槽位,也容易让主要角色形象漂移。
例如,下面这种内容就适合拆成两个场块:
- 女主推门进入宴会厅,众人回头嘲笑;
- 女主抬手展示合同,男主在人群后方认出她。
第一场负责入场压力,第二场负责反击和身份钩子。合成一条长提示词同时生成,动作越多,越容易出现表情崩坏、服装变化和镜头失控。
第八步:给每场绑定参考图
每场开拍前,应构建本场参考素材表。稳定顺序是:
- 场景图;
- 本场道具图;
- 人物定妆图。
有图才占槽位;没有图的内容应标明仅文字,不应假装已经绑定。每场可以绑定多张参考图,并按上述顺序占位,具体数量存在上限。
最重要的一条规则是:有参考图的人物,禁止再用文字描写服装和外观;以参考图为准,文字只写动作、表情和伤情。
这是 AI 漫剧避免换装、换脸的关键。错误写法是同时给系统一张“红裙黑发女主”的定妆图,又在提示词里写“她穿着白色长裙、金发披肩”。模型收到互相冲突的信息,就会重新解释角色。
常见参考图问题怎么处理
| 问题 | 处理方式 |
|---|---|
| 剧本称呼和档案姓名不一致 | 手动绑定角色,如“警官”绑定到“李强” |
| 无关道具干扰画面 | 将该道具从本场参考中排除 |
| 定妆图有多个历史版本 | 选择最适合本场的一张 |
| 穿越或闪回有不同造型 | 按场景时代和地点优先匹配对应造型 |
| 缺少场景或道具图 | 先补图,也可有意跳过纯文字生成 |
缺图时系统可以提醒,但参考图不是强制门禁。创作者可以跳过走纯文字路径;只是通常一致性更难保证,所以专业流程应尽量先定妆、再开拍。
第九步:先画分镜,再写镜头提示词
如果一场戏包含多人互动、明显调度或关键情绪转折,建议先画分镜图。
分镜图是一张灰阶铅笔线稿宫格。分镜师会阅读本场剧本,同时参考人物设定图和场景图,根据这一场的节拍决定 4 格、6 格或 9 格,不为了凑格式硬填满。
分镜阶段要完成四件事:
- 按场景图确定床、柜、窗、门等空间位置;
- 把剧本里有、场景图里没有的关键物件补进去;
- 确定同框人物的高矮和站位;
- 输出一张分镜图和一份镜头清单。
镜头清单应一格一行,写清景别、机位、画面内容、台词和这一格结束时的终态。终态很重要,因为它能限制相邻镜头之间的人物位置和动作衔接。
如果对某一格不满意,不需要整张作废,可以框出那一格,用一句话说明要改什么,只重画局部。也可以保留多套分镜,最后选择最适合表演和节奏的一套。
第十步:按分镜表语言写视频提示词
视频提示词不是小说描写,也不是把剧本复制进去。它应该使用分镜表语言,让模型知道“谁在什么环境里,以什么景别和运镜,完成什么动作,最后停在哪里”。
工程化镜头提示词通常包含八大要素:
- 精准主体;
- 动作细节;
- 场景环境;
- 光影色调;
- 镜头运镜;
- 视觉风格;
- 画质;
- 约束条件。
简单场景可以一段写完;复杂影视化场景适合三段式:
- 总体设定;
- 镜头 1、镜头 2、镜头 3;
- 统一约束包。
写提示词时要遵守几条硬纪律:
- 一个镜头只安排一种主要运镜,不把推、拉、摇、移叠在一起;
- 用镜头序号,不写“0–3 秒”这类绝对秒数;
- 动作要低缓、连续、可执行,减少高爆发动作;
- 多人场景加入防双胞胎、防分身约束;
- 非写实画风要持续锚定风格;
- 台词、音效和音乐符号要区分;
- 只使用本场素材,不把别的场次角色和道具串进来。
台词、音效和 BGM 可以分别使用 {}、<>、() 标记。这样在后续人工审稿时,更容易确认哪些内容是角色说话,哪些是声音设计。
第十一步:选择竖屏规格并提交出片
漫剧默认应按 9:16 竖屏交付,而不是先生成横屏再事后裁切。竖屏构图会影响人物站位、景别和镜头运动,尤其是近景表情、双人对峙和手机端观看体验。
常见输出设置包括:
| 设置项 | 可选思路 |
|---|---|
| 画幅 | 默认 9:16,也可按需求选择其他比例 |
| 时长 | 智能时长或固定 5–15 秒 |
| 模型档位 | 标准、高速、轻量,按质量、成本、速度权衡 |
| 分辨率 | 按所选模型支持范围确定 |
| 音频 | 可按需要生成,水印默认关闭 |
提交前应人工阅读提示词。尤其要检查:
- 本场角色是否绑定正确;
- 有参考图的人物是否还被多余描写外观;
- 道具是否真的需要出现;
- 运镜是否过于复杂;
- 台词和动作是否能在时长内完成;
- 是否误带了其他场的剧情。
确认后再提交。出片时应使用已经确认或编辑过的提示词,以及当时锁定的参考图映射;只有改了词、换了图或调整设置,才构成新的拍摄选择。
第十二步:审片、重拍和多 take 择优
AI 漫剧不会每次都一次成功。专业做法不是看到一条瑕疵片就推翻全流程,而是围绕同一场保留多个 take,根据表演、动作、表情、构图和连贯性择优。
审片时建议按五个维度判断:
| 维度 | 重点 |
|---|---|
| 角色 | 脸、发型、服装、体型是否稳定 |
| 动作 | 是否连续,有无肢体粘连、瞬移 |
| 表情 | 是否符合台词和情绪 |
| 镜头 | 景别、运镜、停顿是否清楚 |
| 连贯性 | 与前后场的位置、伤情、道具是否接得上 |
如果不满意,可以按问题类型返工:
- 角色外观漂移:检查定妆图和提示词里是否有冲突描述;
- 道具错误:调整道具纳入或排除;
- 动作崩坏:降低动作幅度,拆成更多场块;
- 情绪不对:改写动作和表情,不只改形容词;
- 镜头混乱:减少运镜,回到分镜图和镜头序号;
- 画风不统一:检查人物、场景、视频是否共用同一画风路径。
需要强调的是,目前没有成片自动打分或自动择优重拍引擎。系统可以提供多 take、改词、换图和重拍工具,但质量终审仍在创作者和监制手里。
剧本改了,下游怎么处理
漫剧制作中,改剧本很正常。关键是不要让旧角色图、旧道具和旧成片悄悄混在新版本里。
当某一集正文保存或重写后,应按集检查受影响的下游内容:
- 本场出场人物是否需要重新确认;
- 新道具是否需要补设定图;
- 新场景是否需要补场景图;
- 分镜是否需要按新正文重切;
- 已经生成的旧成片是否保留或重拍;
- 人物设定和故事档案是否需要人工复核。
更合理的机制是:勾中的下游项目才重做、才计费;分镜按新正文重新切分不应额外收费;旧成片如果来自旧版正文,应明确标记,是否重拍由创作者决定。
成片后的裁剪、合并与配音
单场出片后,不必立刻搬到外部软件做所有处理。常见后期动作包括:
- 在播放器里设置入点和出点,逐帧步进;
- 裁剪后预览首帧和末帧;
- 将一集里的多场成片按顺序合并;
- 场与场之间使用叠化,片头淡入、片尾淡出;
- 对没有出片的场次给出提示,而不是静默跳过;
- 逐角色设置配音语言和口音。
配音语言和口音应按角色保存,并在全剧生效;它改变的是口条和声音呈现,不应改动剧本里的台词文字。
约 10 秒的场块是工程启发式,不是时间码精剪。个别场次仍可能偏长,站内可以完成裁剪和整集合并,但更复杂的调色、声音设计和精细剪辑,仍应交给专业剪辑软件。
一条可直接执行的 AI 漫剧流程
如果把上面的内容压缩成实操顺序,可以按这张清单执行:
- 写清一句话想法;
- 补齐题材、主角、矛盾、走向、集数、时长、基调、爽点、结局和受众;
- 锁版创意简报;
- 确认角色阵容;
- 建立故事档案;
- 每集先出场戏清单和集末悬念;
- 分批写正文;
- 做剧本规则质检并回填档案;
- 选择 2D 或 3D 漫剧画风;
- 制作人物、场景、道具定妆图;
- 把每集切成约 10 秒场块;
- 给每场绑定场景、道具和人物参考图;
- 关键场绘制宫格分镜;
- 按分镜生成镜头提示词;
- 人工审词并调整;
- 选择 9:16、时长、档位和分辨率;
- 提交出片并保留多个 take;
- 改词、换图、重拍,择优进入整集合并。
这套流程的价值在于,每个环节都有可验收的中间产物:简报、角色、档案、剧本、定妆图、场块、分镜、提示词和成片。它们可以看、可以改、可以回退,而不是把所有风险压到最后一次生成上。
猫斯卡固化了哪些环节
猫斯卡是 AI 竖屏短剧生产操作系统。它没有试图用一次生成替代剧组,而是把短剧工业里已经被验证的质量顺序固化下来:先故事与连续性,再定妆,再分场,再镜头指令,再多 take 择优。
在漫剧制作中,猫斯卡覆盖从创意评估、简报锁版、故事档案、分批剧本、画风选择、人景器定妆、约 10 秒场块、宫格分镜、镜头提示词到竖屏出片和返工的完整链路。系统内有 18 位数字专家,按真实剧组工种分工,创作者可以看到流式工作记录,而不是面对黑箱。
但它也有明确边界:
- 不会替创作者自动判断哪条成片一定最好;
- 缺少参考图时可以提醒,但不能强迫补图;
- 不做跨场自动编排,续写和延长都需要创作者显式发起;
- 角色一致性依赖定妆资产和规范提示词,不是人脸嵌入校验;
- 更精细的剪辑、调色和声音设计仍可能需要外部专业软件。
猫斯卡适合需要持续产出、重视角色一致性和流程可控的漫剧团队;不适合希望完全不审片、不做设定、不接受返工,却要求稳定高质量成片的用法。
常见问题
AI 漫剧和真人短剧在制作上有什么区别?
主要区别在画风。选择 2D 或 3D 动画画风就是漫剧,选择真人写实画风就是真人风格短剧。两者可以共用创意、剧本、故事档案、分场、分镜和出片这条生产链。
一句话真的能做成 AI 漫剧吗?
一句话可以作为创意起点,但不能直接稳定产出成片。还需要补齐主角、核心矛盾、故事走向、集数、时长、爽点、结局和受众,再锁创意简报、写剧本、做定妆和分镜。
AI 漫剧怎么防止角色换脸、换装?
先制作角色定妆图,每场按场景、道具、人物的顺序绑定参考图。有参考图的人物不要再用文字描写服装和外观,文字只写动作、表情和伤情,并在出片前检查是否有冲突描述。
AI 漫剧一场做多长比较合适?
建议把剧本切成约 10 秒一个视频场块,通常可控制在 5–15 秒。动作越多、人物越多,越应拆细,不要用一条长提示词完成复杂调度。
剧本改了,已经画好的图和拍好的视频怎么办?
应按集检查受影响的人物、场景、道具、分镜和成片。需要重做的下游项目逐项确认,旧成片应保留并标记是否来自旧版正文,是否重拍由创作者决定。
AI 漫剧能不能完全自动出成片?
不能把质量寄托在完全自动上。系统可以固化流程、生成资产和提供多 take,但剧情方向、审美判断、提示词审核和最终选片仍需要人来完成。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com