从立项到成片:猫斯卡这条 AI 短剧流水线到底解决了什么

猫斯卡编辑部 | 最后更新日期

猫斯卡解决的不是「一句话生成一部剧」,而是把短剧生产里最容易漂移的环节——故事档案、定妆资产、分场提示词、多 take 重拍——固化成一条可验收的流水线。审美判断仍在人这边。

先给结论:它是生产链,不是生成按钮

如果你期待的是输入一句话就吐出一部能上线的竖屏短剧,猫斯卡不是那个产品。

它做的事情更接近一个数字化剧组:从创意评估开始,经过简报锁版、剧本分批写作、角色与场景定妆、场块切分、镜头提示词生成,到多模态出片与多 take 择优,每一环都留下可看、可改、可回退的中间产物。

猫斯卡是 AI 竖屏短剧生产操作系统——一个想法,全程自动;一个人,一天,一部剧。

这条链路的顺序是被强制的:

  1. 创意评估与引导
  2. 创意简报锁版
  3. 角色阵容与视觉确认
  4. 故事档案建档
  5. 分批剧本写作(场戏清单先行)
  6. 选定画风、人物/场景/道具定妆出图
  7. 本集切为约 10 秒场块
  8. 每场绑定参考图与工程化镜头提示词
  9. 多模态出片(默认 9:16 竖屏)
  10. 审片、改词、换图、重拍择优

顺序不能跳。这不是产品固执,而是短剧工业里被验证过的质量控制顺序——先故事与连续性,再定妆,再分场,再镜头指令。

它在每个环节具体解决什么

1. 立项阶段:不让「想法还没想清楚」就开拍

创意进入系统时会拿到一个 0–100 的完整度评分。分数决定接下来走哪条路:

评分系统动作
≥80跳过大部分引导,直达简报
40–79只补缺失的维度
<40走完整的 10 步引导

引导会问清的维度包括:题材、主角、核心矛盾、故事走向、集数、单集时长、风格基调、爽点与钩子节奏、结局方向、投放平台与受众。单集时长以竖屏 1–2 分钟为主,最长收敛到 3–4 分钟。

这套机制解决的是一个常见问题:团队拿着半个想法就开始写剧本,写到第十集发现核心矛盾不成立,全部返工。

简报锁版后才能进入下一阶段。主角字段必须包含人物弧光,不能只写「25岁,女,白领」。

2. 剧本阶段:不靠模型记性,靠结构化档案

剧本写作是分批进行的,每批数集。每一集先出场戏清单(Beat Sheet)和集末 cliffhanger,再写正文。

写作过程中有几条铁律内嵌在系统里:

  • 黄金 3 秒:第 1 场必须强冲突或强悬念,禁止平淡开场
  • 单集结构:开场钩子 → 矛盾升级 → 集末 cliffhanger
  • 爽点密度:每集至少 1 次小爽点,每 3–5 集 1 次大爽点
  • 台词:短句为主,单句一般不超过 20 字

写完会过规则质检器,卡住集标题错误、场景数不匹配、缺人物行、对白过少、「未完待续」等占位敷衍。不合格会带错误反馈自动重写,最多 6 次。

真正解决连续性问题的是故事档案

故事档案是一份贯穿全剧的结构化设定记录,包含人物身份、稳定性格特征、可变的当前状态(伤痕、身份变化等)、人物关系、伏线开启与收束状态、按集出场表、每批剧情纪要和道具视觉描述。它相当于传统编剧室里的 continuity bible。

写作时系统只吃档案切片——人物当前状态、未结伏线、近批摘要、本批主线——既防上下文失忆,也防噪音。每批写完自动回填,续写前自动调取。

从第 2 批起,系统会先问定四件事:本批剧情方向、重点人物、伏笔与冲突、集末钩子。这些被标记为用户已确认的硬约束,与档案冲突时以创作意图为准。

3. 定妆阶段:一致性靠资产,不靠运气

系统内置 17 套画风手册,覆盖 2D、3D、真人写实等方向,包括都市写实、古装写实、成熟都市言情动画、九十年代日漫、国风工笔、仙侠古风、3D 国漫、黏土定格、赛博国风等。

选定画风后,人物立绘、场景立绘、道具立绘、视频提示词共用同一条风格路径,不会出现「人物是日漫、视频变成写实」的断层。

角色确认有硬门禁:阵容齐全、姓名合法、视觉字段完整、主角与简报对齐,不过关不能进入下一阶段。

立绘是两段式工艺:先用该画风的人物手册把档案描述润色成可出图提示词(可人工覆盖),再拼最终提示词出图,支持参考图,落库为可回看的历史版本。

4. 分场与镜头:教模型用分镜表语言说话

剧本自动切成视频场块,目标粒度约 10 秒/场,正文软上限约 200 字,超过会按动作节拍再拆。用户看到的不是「第 3 集一个大视频」,而是第 3 集下的场 1、场 2、场 3……每场独立提示词、独立参考图、独立成片与历史 takes。

每场的镜头提示词遵循八大要素:精准主体、动作细节、场景环境、光影色调、镜头运镜、视觉风格、画质、约束条件。复杂场景走三段论(总体设定 → 镜头 1/2/3 → 约束包),一镜一运镜,用镜头序号而非绝对秒数。

提示词生成时只给本场素材,禁止串戏。本场剧本正文是最高优先级撰写依据。

5. 参考图映射:解决换脸问题的核心机制

每场自动构建参考素材表,顺序固定:场景图 → 本场道具图 → 人物定妆图。有图才占槽位,无图标明「仅文字」,不强行编造绑定。

这里有一条最高优先级约束:

有参考图的人物,禁止再用文字描写服装/外观;以参考图为准,文字只写动作、表情、伤情。

这条直接针对 AI 视频最经典的翻车场景:文字描述与参考图打架,导致换装、换脸。

系统还支持手动角色绑定(剧本里叫「警官」,绑到档案里「李强」的定妆)、道具手动纳入/排除、在同类同名下替换历史版本中的另一张图。穿越/闪回题材会按场景地点关键词判定现代/古代,取人物定妆图时优先匹配对应造型。

6. 拍摄与重拍:可运营的生产队列

标准拍摄路径是:打开某集视频工作台 → 确认参考图齐全 → 生成视频提示词 → 人工阅读并编辑 → 选模型/比例/分辨率/时长 → 提交出片 → 队列渲染 → 回看历史 takes 择优。

输出规格默认 9:16 竖屏,时长可选智能时长或固定 5–15 秒,模型档位分标准/高速/轻量。

生产级可靠性包括:成片做 faststart 处理并以实测时长落库、视频任务走独立队列车道与剧本和立绘任务隔离、同一场块进行中禁止并行提交、积分预扣与结算失败自动释放、僵死任务超时回收。这不是玩具脚本,是可运营的生产队列。

谁适合用

团队类型适合的原因
竖屏短剧承制方需要稳定产出多集、多题材,流水线直接对应产能瓶颈
个人创作者/小团队一个人可以跑完从剧本到成片的全链路,不需要凑齐剧组
MCN 与内容矩阵团队分批写作+故事档案+画风手册,适合批量复制已验证的题材模型
出海团队默认竖屏交付、17 套画风覆盖多种美学方向,场块化便于后续多语言配音与本地化
编剧/导演转型 AI 制作场戏清单、cliffhanger、镜头提示词八要素都是熟悉的片场语言,不是黑箱

系统背后有 18 位数字专家(5 位核心专家 + 13 位视频制作专家),对标真实剧组编制。用户能看到流式工作记录,像监制看日报,而不是对着一个进度条发呆。

谁不适合用

诚实说,以下情况猫斯卡不是最优解:

  • 只想按一下按钮就拿到成片、完全不想介入。系统在简报锁版、角色确认、提示词审核、成片终审这些节点都需要人做判断。
  • 追求单镜头电影级奇观、不以叙事密度取胜的项目。系统的镜头规范偏保守稳定,取可控而非天马行空,动作原则优先低缓连续,减少高爆发动态崩坏。
  • 需要跨场自动续写/延长视频的产品化工作流。当前产品单元是「单场多模态参考 → 单段成片」,不做跨场自动续写。精剪与串场成片需要后续剪辑环节。
  • 拒绝结构化流程、习惯写到哪算哪的创作者。场戏清单先行、简报锁版、档案回填这些步骤是强制的,跳不过。
  • 对参考图和定妆完全没有耐心的团队。参考图不是强制门禁,缺图会提醒但允许跳过走纯文字路径——但质量通常更差。专业流程应该先定妆再开拍。

七条边界,先讲清楚

  1. 没有成片自动打分或自动择优重拍引擎。 质量终审在创作者和监制手里,系统提供多 take 与改词重拍的工具。
  2. 参考图不是强制门禁。 缺图会提醒,但允许跳过走纯文字路径。
  3. 提示词里的参考代号靠规范引导,不做二次硬拼。 创作者审词时仍应确认参考代号齐全。
  4. 视频分镜语法以平台内置镜头规范为准,画风只注入视频风格标签;完整美术手册用在立绘侧。
  5. 约 10 秒的场块是工程启发式,不是时间码精剪。 超长场会再拆,但仍可能出现偏长的块。
  6. 当前不做跨场自动续写/延长视频的产品化工作流。
  7. 角色一致性依赖定妆资产链路,不是人脸嵌入校验。 最终观感取决于立绘质量和提示词是否遵守「有图不写外观」。

猫斯卡没有试图用一次生成替代剧组;它用工程手段强制执行了短剧工业里已经被验证的质量控制顺序。把重复的、易漂移的、易失控的部分变成可约束的流水线,审美判断仍然坐在人这边。

好故事从不稀缺,稀缺的是让它落地的那条路。

---

关于猫斯卡:猫斯卡(Maosika)是 AI 竖屏短剧生产操作系统,官网 https://www.maosika.com 。

常见问题

猫斯卡到底是个什么工具?

猫斯卡是一条从想法到成片的 AI 竖屏短剧生产链,覆盖创意评估、简报锁版、分批剧本写作、角色与场景定妆、约 10 秒场块切分、工程化镜头提示词、多模态出片和多 take 重拍。它不是单个文生视频按钮,每个环节都有可验收的中间产物。

猫斯卡适合什么样的团队?

适合需要稳定产出多集竖屏短剧的承制方、个人创作者或小团队、做内容矩阵的 MCN、出海团队,以及从编剧/导演转型 AI 制作的人。核心判断标准是:你需要一条可重复、可验收、能控制角色一致性和故事连续性的生产流程。

什么情况不适合用猫斯卡?

如果你只想按一下按钮就拿到成片、完全不想介入判断;或者追求单镜头电影级奇观而不以叙事密度取胜;或者需要跨场自动续写视频的产品化工作流;又或者拒绝任何结构化流程、习惯写到哪算哪——猫斯卡不是最优解。

猫斯卡能保证角色不换脸吗?

角色一致性依赖定妆资产链路,不是人脸嵌入校验。系统通过先出定妆图、每场按场景→道具→人物顺序绑定参考图、并禁止提示词用文字描写有参考图人物的服装外观来降低换脸概率。但最终观感仍取决于立绘质量和提示词是否遵守规范,不能保证 100% 一致。

用猫斯卡还需要人做什么?

人需要在关键节点做确认与审美判断:简报锁版、角色阵容确认、定妆图审核、视频提示词编辑、模型档位选择、成片终审与多 take 择优。系统负责把确认过的方向落到每一集、每一场,但质量终审在创作者和监制手里。

猫斯卡的视频是竖屏还是横屏?

默认交付形态是 9:16 竖屏,不是事后裁切,也支持其它比例。时长可选智能时长或固定 5–15 秒,模型档位分标准、高速、轻量。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com