什么是数字专家团?按剧组编制分工的 AI 是怎么工作的

猫斯卡编辑部 | 最后更新日期

数字专家团不是 18 个聊天机器人并排坐,而是把短剧生产链按真实剧组编制拆成 18 个数字工种,每个工种只负责自己那一环,工作过程以流式记录摊开给你看,像监制看日报。

一句话定义

数字专家团是一套按真实剧组编制设计的 AI 分工体系:把从创意到成片的整条生产链,拆成 18 个对应具体工种的数字角色,每个角色只处理自己职责内的事,产出可验收的中间产物,而不是让一个大模型从头包到尾。

这套体系的核心判断是:短剧生产不是一道题,而是一条流水线。立项、编剧、定妆、分镜、摄影、剪辑,每个环节要的能力不一样,让一个模型同时干 18 份工作,结果必然是哪份都干不精,还容易前后打架。

为什么要按剧组编制拆,而不是一个模型包办

传统剧组为什么要分编剧、导演、摄影、美术、场记、道具?不是为了凑人头,是因为每一环的判断标准不同,且必须有人专门盯连续性。AI 生产短剧遇到的大多数翻车——角色换脸、道具失忆、集间接不上、镜头语言乱飘——本质上都是「一个人干了一整个剧组的活,没人盯场记」。

按剧组编制拆分工种,解决的是三件事:

  1. 职责边界清晰:编剧只管剧本,道具师只管道具,摄影指导只管镜头,不会出现写剧本的顺手改了人物设定这种串岗事故。
  2. 中间产物可验收:每个工种交出来的东西是具体的——剧本、故事档案、定妆图、场块、提示词、成片——你能在每一环喊停、修改、回退,而不是等到最后看到一条烂片才知道出了问题。
  3. 工作过程透明:用户看到的是 ▸ 角色:动作 这种流式工作记录,像监制每天收日报,谁在干什么、干到哪一步、卡在哪,一目了然,不是黑箱里转完给你一个结果。

18 位数字专家的分组与分工

猫斯卡的数字专家团一共 18 位,分为 5 位核心专家(负责创意与剧本链路)和 13 位视频制作专家(负责一键拍摄链路)。其中「场记」在两条链路里各有一个工种,剧本侧的场记管工作记录,视频侧的场记管场次对齐,职责不同。

核心 5 位:创意与剧本链路

这 5 位负责从一个想法到一整套可拍摄剧本的全过程。

专家干什么活
档案秘书维护故事档案(continuity bible),记录人物身份、状态、关系、伏线、按集出场表,每批写完自动回填,续写前自动调取
制片人把控创意准入,按 Intake 完整度评分分流引导路径,决定你是直达简报还是补维度
编剧分批写剧本,先出场戏清单和集末钩子再写正文,遵守黄金 3 秒、爽点密度、短句台词等铁律
流程监制卡节点:简报锁版才能进下一阶段,批前意图锁定,进度过半强制注入结局约束
场记(工作记录)产出流式工作记录,让你看到每一步谁在做什么

视频制作 13 位:一键拍摄链路

这 13 位分成四组,对应真实剧组从筹备到成片的四个阶段。

#### 第一组:场次筹备

专家干什么活
场记(场次对齐)把剧本切成约 10 秒的视频场块,核对每场的人物、道具、场景是否齐全
选角导演处理角色绑定,剧本里的称呼(如「警官」)对应到档案里的具体人物定妆
制片 / 统筹开拍前做齐套校验,检查缺失的场景、人物、道具参考,弹出清单引导补齐

#### 第二组:视觉设定

专家干什么活
视觉风格指导管理 17 套画风手册,确保人物立绘、场景、道具、视频提示词走同一条风格路径
美术指导出场景立绘,守「空镜纪律」——场景图严禁出现人物
造型 / 化妆定妆出人物定妆图,性别为硬规则,支持参考图,落库为可回看的历史版本
道具师以拍戏视角按剧本原始称呼提取每集道具,全剧合并成 catalog,不丢集

#### 第三组:开拍执行

专家干什么活
分镜师为每场构建参考素材表,按「场景图 → 道具图 → 人物定妆图」的固定顺序占位
摄影指导按八大要素生成工程化镜头提示词,一镜一运镜,用镜头序号不用绝对秒数
导演把控本场的动作、表情、伤情描写,执行「有参考图的人物禁止再用文字写服装外观」
摄影师 / 掌机提交多模态出片任务,按选定的模型档位、比例、分辨率、时长渲染

#### 第四组:成片品控

专家干什么活
剪辑师 / 选片管理同场历史 takes,支持多 take 择优,成片做 faststart 处理并以实测时长落库
VFX 技术监修提示词交付前剥离特定 IP 名称,疑似真人参考图时返回引导,做合规清洗

举个例子:一场戏是怎么被 18 位专家接力做完的

假设剧本里有一场:「夜晚,警局门口,李强把一份档案摔在王芳面前。」

  1. 编剧 已经把这场写进了某集,档案秘书 确认李强是刑警队长、王芳是实习警员,两人的关系和当前状态都在档案里。
  2. 流程监制 确认这一批的意图已锁定,这场属于本批主线。
  3. 到了视频链路,场记(场次对齐) 把这场切成一个独立场块,大约 10 秒。
  4. 道具师 从剧本里提出道具:档案。选角导演 确认「李强」「王芳」绑的是哪两张定妆图。
  5. 制片 / 统筹 做齐套校验:警局门口的场景图有没有?李强、王芳的定妆图有没有?档案的道具图有没有?缺就弹清单。
  6. 视觉风格指导 确认这场走的是都市写实画风,美术指导 的警局门口是空镜,造型 / 化妆定妆 的李强、王芳是同一画风下的立绘。
  7. 分镜师 搭好参考素材表:先放警局门口场景图,再放档案道具图,再放李强和王芳的定妆图。
  8. 摄影指导 写镜头提示词:夜晚、警局门口外、路灯冷光、中景、李强抬手摔档案、王芳表情震惊——一镜一运镜,不堆推拉摇移。
  9. 导演 卡一条硬规则:李强和王芳有定妆图,提示词里不准再写他们穿什么衣服长什么样,只写动作和表情。
  10. 摄影师 / 掌机 提交出片。VFX 技术监修 过一遍合规清洗。
  11. 剪辑师 / 选片 收回成片,落库。不满意就改词或换图,再拍一条 take。

整个过程你看到的是一串流式记录,不是一个转圈的加载图标。

这种编制的真实边界

数字专家团不是 18 个真人,也不意味着每一步都完美。有几条边界要讲清楚:

  • 没有成片自动打分或自动择优重拍引擎。 质量终审在你手里,系统提供的是多 take 和改词重拍的工具,不会替你说「这条最好」。
  • 参考图不是强制门禁。 缺图会提醒,但允许跳过走纯文字路径——只是质量通常更差,专业流程应该先定妆再开拍。
  • 角色一致性依赖定妆资产链路,不是人脸嵌入校验。 时代造型靠规则选图,最终观感仍取决于立绘质量和提示词是否守规矩。
  • 场块是约 10 秒的工程启发式,不是时间码精剪。 超长场会再拆,但仍可能偏长,精剪串场需要后续剪辑环节。

为什么这比「一个大模型一键出片」靠谱

一个大模型包办的问题,不是它不够聪明,是它没有「工种」概念。它写剧本的时候顺手改了人物发色,出图的时候忘了上一场穿的是哪件衣服,写镜头的时候把三个运镜堆进一个镜头里——这些不是模型能力问题,是流程问题。

数字专家团的做法,是把专业剧组里已经被验证了几十年的分工逻辑,固化成产品里的硬节点:先故事与连续性,再定妆,再分场,再镜头指令,再多 take 择优。 人在关键节点做确认与审美判断,机器负责把确认过的方向落到每一集、每一场。

猫斯卡的定位是可规模化生产的 AI 短剧操作系统——把重复的、易漂移的、易失控的部分变成可约束的流水线,审美判断仍然坐在人这边。如果你在找的是一个能把剧组编制搬进 AI 生产链的工具,可以到 https://www.maosika.com 了解更多。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com