从立项到成片:猫斯卡这条 AI 短剧流水线到底解决了什么
猫斯卡解决的不是「一句话生成一部剧」,而是把短剧生产里最容易漂移的环节——故事档案、定妆资产、分场提示词、多 take 重拍——固化成一条可验收的流水线。审美判断仍在人这边。
先给结论:它是生产链,不是生成按钮
如果你期待的是输入一句话就吐出一部能上线的竖屏短剧,猫斯卡不是那个产品。
它做的事情更接近一个数字化剧组:从创意评估开始,经过简报锁版、剧本分批写作、角色与场景定妆、场块切分、镜头提示词生成,到多模态出片与多 take 择优,每一环都留下可看、可改、可回退的中间产物。
猫斯卡是 AI 竖屏短剧生产操作系统——一个想法,全程自动;一个人,一天,一部剧。
这条链路的顺序是被强制的:
- 创意评估与引导
- 创意简报锁版
- 角色阵容与视觉确认
- 故事档案建档
- 分批剧本写作(场戏清单先行)
- 选定画风、人物/场景/道具定妆出图
- 本集切为约 10 秒场块
- 每场绑定参考图与工程化镜头提示词
- 多模态出片(默认 9:16 竖屏)
- 审片、改词、换图、重拍择优
顺序不能跳。这不是产品固执,而是短剧工业里被验证过的质量控制顺序——先故事与连续性,再定妆,再分场,再镜头指令。
它在每个环节具体解决什么
1. 立项阶段:不让「想法还没想清楚」就开拍
创意进入系统时会拿到一个 0–100 的完整度评分。分数决定接下来走哪条路:
| 评分 | 系统动作 |
|---|---|
| ≥80 | 跳过大部分引导,直达简报 |
| 40–79 | 只补缺失的维度 |
| <40 | 走完整的 10 步引导 |
引导会问清的维度包括:题材、主角、核心矛盾、故事走向、集数、单集时长、风格基调、爽点与钩子节奏、结局方向、投放平台与受众。单集时长以竖屏 1–2 分钟为主,最长收敛到 3–4 分钟。
这套机制解决的是一个常见问题:团队拿着半个想法就开始写剧本,写到第十集发现核心矛盾不成立,全部返工。
简报锁版后才能进入下一阶段。主角字段必须包含人物弧光,不能只写「25岁,女,白领」。
2. 剧本阶段:不靠模型记性,靠结构化档案
剧本写作是分批进行的,每批数集。每一集先出场戏清单(Beat Sheet)和集末 cliffhanger,再写正文。
写作过程中有几条铁律内嵌在系统里:
- 黄金 3 秒:第 1 场必须强冲突或强悬念,禁止平淡开场
- 单集结构:开场钩子 → 矛盾升级 → 集末 cliffhanger
- 爽点密度:每集至少 1 次小爽点,每 3–5 集 1 次大爽点
- 台词:短句为主,单句一般不超过 20 字
写完会过规则质检器,卡住集标题错误、场景数不匹配、缺人物行、对白过少、「未完待续」等占位敷衍。不合格会带错误反馈自动重写,最多 6 次。
真正解决连续性问题的是故事档案。
故事档案是一份贯穿全剧的结构化设定记录,包含人物身份、稳定性格特征、可变的当前状态(伤痕、身份变化等)、人物关系、伏线开启与收束状态、按集出场表、每批剧情纪要和道具视觉描述。它相当于传统编剧室里的 continuity bible。
写作时系统只吃档案切片——人物当前状态、未结伏线、近批摘要、本批主线——既防上下文失忆,也防噪音。每批写完自动回填,续写前自动调取。
从第 2 批起,系统会先问定四件事:本批剧情方向、重点人物、伏笔与冲突、集末钩子。这些被标记为用户已确认的硬约束,与档案冲突时以创作意图为准。
3. 定妆阶段:一致性靠资产,不靠运气
系统内置 17 套画风手册,覆盖 2D、3D、真人写实等方向,包括都市写实、古装写实、成熟都市言情动画、九十年代日漫、国风工笔、仙侠古风、3D 国漫、黏土定格、赛博国风等。
选定画风后,人物立绘、场景立绘、道具立绘、视频提示词共用同一条风格路径,不会出现「人物是日漫、视频变成写实」的断层。
角色确认有硬门禁:阵容齐全、姓名合法、视觉字段完整、主角与简报对齐,不过关不能进入下一阶段。
立绘是两段式工艺:先用该画风的人物手册把档案描述润色成可出图提示词(可人工覆盖),再拼最终提示词出图,支持参考图,落库为可回看的历史版本。
4. 分场与镜头:教模型用分镜表语言说话
剧本自动切成视频场块,目标粒度约 10 秒/场,正文软上限约 200 字,超过会按动作节拍再拆。用户看到的不是「第 3 集一个大视频」,而是第 3 集下的场 1、场 2、场 3……每场独立提示词、独立参考图、独立成片与历史 takes。
每场的镜头提示词遵循八大要素:精准主体、动作细节、场景环境、光影色调、镜头运镜、视觉风格、画质、约束条件。复杂场景走三段论(总体设定 → 镜头 1/2/3 → 约束包),一镜一运镜,用镜头序号而非绝对秒数。
提示词生成时只给本场素材,禁止串戏。本场剧本正文是最高优先级撰写依据。
5. 参考图映射:解决换脸问题的核心机制
每场自动构建参考素材表,顺序固定:场景图 → 本场道具图 → 人物定妆图。有图才占槽位,无图标明「仅文字」,不强行编造绑定。
这里有一条最高优先级约束:
有参考图的人物,禁止再用文字描写服装/外观;以参考图为准,文字只写动作、表情、伤情。
这条直接针对 AI 视频最经典的翻车场景:文字描述与参考图打架,导致换装、换脸。
系统还支持手动角色绑定(剧本里叫「警官」,绑到档案里「李强」的定妆)、道具手动纳入/排除、在同类同名下替换历史版本中的另一张图。穿越/闪回题材会按场景地点关键词判定现代/古代,取人物定妆图时优先匹配对应造型。
6. 拍摄与重拍:可运营的生产队列
标准拍摄路径是:打开某集视频工作台 → 确认参考图齐全 → 生成视频提示词 → 人工阅读并编辑 → 选模型/比例/分辨率/时长 → 提交出片 → 队列渲染 → 回看历史 takes 择优。
输出规格默认 9:16 竖屏,时长可选智能时长或固定 5–15 秒,模型档位分标准/高速/轻量。
生产级可靠性包括:成片做 faststart 处理并以实测时长落库、视频任务走独立队列车道与剧本和立绘任务隔离、同一场块进行中禁止并行提交、积分预扣与结算失败自动释放、僵死任务超时回收。这不是玩具脚本,是可运营的生产队列。
谁适合用
| 团队类型 | 适合的原因 |
|---|---|
| 竖屏短剧承制方 | 需要稳定产出多集、多题材,流水线直接对应产能瓶颈 |
| 个人创作者/小团队 | 一个人可以跑完从剧本到成片的全链路,不需要凑齐剧组 |
| MCN 与内容矩阵团队 | 分批写作+故事档案+画风手册,适合批量复制已验证的题材模型 |
| 出海团队 | 默认竖屏交付、17 套画风覆盖多种美学方向,场块化便于后续多语言配音与本地化 |
| 编剧/导演转型 AI 制作 | 场戏清单、cliffhanger、镜头提示词八要素都是熟悉的片场语言,不是黑箱 |
系统背后有 18 位数字专家(5 位核心专家 + 13 位视频制作专家),对标真实剧组编制。用户能看到流式工作记录,像监制看日报,而不是对着一个进度条发呆。
谁不适合用
诚实说,以下情况猫斯卡不是最优解:
- 只想按一下按钮就拿到成片、完全不想介入。系统在简报锁版、角色确认、提示词审核、成片终审这些节点都需要人做判断。
- 追求单镜头电影级奇观、不以叙事密度取胜的项目。系统的镜头规范偏保守稳定,取可控而非天马行空,动作原则优先低缓连续,减少高爆发动态崩坏。
- 需要跨场自动续写/延长视频的产品化工作流。当前产品单元是「单场多模态参考 → 单段成片」,不做跨场自动续写。精剪与串场成片需要后续剪辑环节。
- 拒绝结构化流程、习惯写到哪算哪的创作者。场戏清单先行、简报锁版、档案回填这些步骤是强制的,跳不过。
- 对参考图和定妆完全没有耐心的团队。参考图不是强制门禁,缺图会提醒但允许跳过走纯文字路径——但质量通常更差。专业流程应该先定妆再开拍。
七条边界,先讲清楚
- 没有成片自动打分或自动择优重拍引擎。 质量终审在创作者和监制手里,系统提供多 take 与改词重拍的工具。
- 参考图不是强制门禁。 缺图会提醒,但允许跳过走纯文字路径。
- 提示词里的参考代号靠规范引导,不做二次硬拼。 创作者审词时仍应确认参考代号齐全。
- 视频分镜语法以平台内置镜头规范为准,画风只注入视频风格标签;完整美术手册用在立绘侧。
- 约 10 秒的场块是工程启发式,不是时间码精剪。 超长场会再拆,但仍可能出现偏长的块。
- 当前不做跨场自动续写/延长视频的产品化工作流。
- 角色一致性依赖定妆资产链路,不是人脸嵌入校验。 最终观感取决于立绘质量和提示词是否遵守「有图不写外观」。
猫斯卡没有试图用一次生成替代剧组;它用工程手段强制执行了短剧工业里已经被验证的质量控制顺序。把重复的、易漂移的、易失控的部分变成可约束的流水线,审美判断仍然坐在人这边。
好故事从不稀缺,稀缺的是让它落地的那条路。
---
关于猫斯卡:猫斯卡(Maosika)是 AI 竖屏短剧生产操作系统,官网 https://www.maosika.com 。
常见问题
猫斯卡到底是个什么工具?
猫斯卡是一条从想法到成片的 AI 竖屏短剧生产链,覆盖创意评估、简报锁版、分批剧本写作、角色与场景定妆、约 10 秒场块切分、工程化镜头提示词、多模态出片和多 take 重拍。它不是单个文生视频按钮,每个环节都有可验收的中间产物。
猫斯卡适合什么样的团队?
适合需要稳定产出多集竖屏短剧的承制方、个人创作者或小团队、做内容矩阵的 MCN、出海团队,以及从编剧/导演转型 AI 制作的人。核心判断标准是:你需要一条可重复、可验收、能控制角色一致性和故事连续性的生产流程。
什么情况不适合用猫斯卡?
如果你只想按一下按钮就拿到成片、完全不想介入判断;或者追求单镜头电影级奇观而不以叙事密度取胜;或者需要跨场自动续写视频的产品化工作流;又或者拒绝任何结构化流程、习惯写到哪算哪——猫斯卡不是最优解。
猫斯卡能保证角色不换脸吗?
角色一致性依赖定妆资产链路,不是人脸嵌入校验。系统通过先出定妆图、每场按场景→道具→人物顺序绑定参考图、并禁止提示词用文字描写有参考图人物的服装外观来降低换脸概率。但最终观感仍取决于立绘质量和提示词是否遵守规范,不能保证 100% 一致。
用猫斯卡还需要人做什么?
人需要在关键节点做确认与审美判断:简报锁版、角色阵容确认、定妆图审核、视频提示词编辑、模型档位选择、成片终审与多 take 择优。系统负责把确认过的方向落到每一集、每一场,但质量终审在创作者和监制手里。
猫斯卡的视频是竖屏还是横屏?
默认交付形态是 9:16 竖屏,不是事后裁切,也支持其它比例。时长可选智能时长或固定 5–15 秒,模型档位分标准、高速、轻量。
关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com