把 AI 拆成 18 个岗位:短剧数字剧组的分工逻辑

猫斯卡编辑部 | 最后更新日期

数字专家团的本质,是把「一个全能 AI」拆成 18 个按剧组编制分工的岗位,每个岗位只在自己的工序出场、只对自己的交接物负责。它解决的不是「AI 够不够聪明」,而是「谁在什么时候该做什么决定」。

为什么要把 AI 拆成岗位

一个对话式 AI 写短剧,常见的崩法不是它不会写,而是它什么都想干、又记不住自己干过什么:上一句还是编剧在铺人物,下一句突然替导演决定了运镜;第 3 集埋的伏笔,到第 8 集自己忘了。

数字专家团是另一种思路:不让一个模型扮演全剧组,而是让每个工种只做自己那一段。编剧不碰镜头,摄影不改正文,场记只管对齐,档案秘书只管记忆。每个岗位有明确的输入、输出和下一道工序。

数字专家团是一组按真实剧组编制设计的 AI 岗位,共 18 位(5 位核心专家负责创意与剧本链路,13 位视频制作专家负责从筹备到成片的拍摄链路),用户可以看到每位专家的流式工作记录,像监制看日报,而不是对着一个黑箱等结果。

这一定义里有三个关键词:编制、顺序、交接物

18 个岗位,两条链路

数字专家团不是一拥而上,而是分两条链路、按工序出场。

创意与剧本链路:5 位核心专家

岗位主要职责交接物
档案秘书建立并维护故事档案,回填人物状态、伏线、剧情纪要结构化故事档案
制片人评估创意完整度,决定走完整引导还是直达简报创意准入判断
编剧先出场戏清单,再写正文,遵守竖屏写作铁律分集剧本
流程监制卡住顺序:简报没锁版不能写、质检没过不交付流程门禁
场记(工作记录)记录剧本链路的工作流,让每一步可追溯流式工作记录

这里的「场记」和视频链路里的「场记」是两个工种、同名不同责,后面会讲。

视频制作链路:13 位专家,四组

剧本定稿、角色与画风确认之后,才轮到视频侧的 13 位。他们按真实拍摄的筹备—执行—品控顺序分组:

分组岗位干什么
场次筹备场记(场次对齐)把剧本切成约 10 秒的场块,对齐场次与参考素材
场次筹备选角导演确认本场出场人物与定妆图的绑定
场次筹备制片 / 统筹检查参考图是否齐套,调度出片队列
视觉设定视觉风格指导把选定画风注入人物、场景、道具与视频风格
视觉设定美术指导出场景与环境立绘
视觉设定造型 / 化妆定妆出人物定妆图,守住面容与性别锚点
视觉设定道具师以拍戏视角按集提取道具,建立道具目录
开拍执行分镜师把场块转成镜头序号与运镜安排
开拍执行摄影指导决定光影、机位、运镜,一镜一运镜
开拍执行导演统筹表演、节奏与镜头意图
开拍执行摄影师 / 掌机把镜头指令落到可出片的提示词
成片品控剪辑师 / 选片管理同场多个 take,支持择优与重拍
成片品控VFX 技术监修兜底画质、面部稳定、分身等技术问题

注意分组顺序本身就是工艺顺序:先筹备,再视觉,再开拍,最后品控。跳步就会出问题——比如人物还没定妆就开拍,等于让演员穿着便服上镜。

岗位之间怎么交接

数字剧组能跑起来,靠的不是 18 个 AI 互相聊天,而是每一步都有可验收的中间产物

完整链路是这样的:

  1. 创意评估给一个 0–100 的完整度分数,决定引导深度
  2. 创意简报锁版(一句话故事、核心矛盾、人物弧光、爽点钩子节奏等字段固化)
  3. 角色阵容与视觉确认,过齐套校验
  4. 故事档案建档
  5. 分批剧本写作:场戏清单先行 → 正文 → 规则质检 → 档案回填
  6. 选定画风(17 套内置手册之一)
  7. 人物 / 场景 / 道具定妆出图
  8. 每集切为约 10 秒的场块
  9. 每场绑定参考图(场景 → 道具 → 人物的顺序)并生成镜头提示词
  10. 多模态出片,默认 9:16 竖屏
  11. 审片、改词、换图、重拍择优

每一步的产物都可看、可改、可回退。编剧写完不是直接进视频模型,而是先过规则质检器;提示词生成完不是直接出片,而是先让人读、让人改。

流式工作记录:监制视角,而不是黑箱

用户在猫斯卡看到的不是一个转圈的加载图标,而是持续滚动的工作记录,形如「▸ 角色:动作」。档案秘书回填了哪条伏线、道具师从这集提了哪几样道具、分镜师把这场拆成了几个镜头——都看得见。

这件事的价值不只是「透明」,而是可追责。当第 5 集人物突然换了件衣服,你能回头查到是参考图绑定环节出了问题,还是提示词里多写了一句服装描写——而不是只能对着成片猜。

两个同名的「场记」

18 位专家里有两个「场记」,这是刻意的,不是计数错误:

  • 剧本链路的场记负责工作记录,相当于编剧室里盯进度、留痕的人;
  • 视频链路的场记负责场次对齐,把剧本结构化成场块、对齐参考素材,相当于拍摄现场拿场记板的人。

两者在真实剧组里本就是不同环节的工种,只是中文名相同。所以全站统一口径是「18 位数字专家(5 位核心 + 13 位视频制作)」。

人在哪些节点必须拍板

数字专家团不是「18 个 AI 自己把剧拍完」。人在关键节点做确认与审美判断,机器负责把确认过的方向落到每一集、每一场。必须由人拍板的节点包括:

  • 创意简报锁版(不锁不能进下一步)
  • 角色阵容与视觉字段确认
  • 画风选择
  • 定妆图确认(可人工覆盖提示词重出)
  • 视频提示词的人工阅读与编辑
  • 模型档位、比例、分辨率、时长选择
  • 审片与多 take 择优

换句话说,AI 负责把重复、易漂移、易失控的部分变成可约束的流水线,审美判断仍然坐在人这边

这套编制做不到什么

主动划清边界,比夸大能力更能建立信任:

  • 没有成片自动打分或自动择优重拍引擎,终审在人
  • 参考图不是强制门禁,缺图会提醒但允许跳过(质量通常更差)
  • 约 10 秒的场块是工程启发式,不是时间码精剪,精剪与串场仍需后续剪辑
  • 当前不做跨场自动续写或延长视频的产品化工作流,单元是「单场参考 → 单段成片」
  • 角色一致性依赖定妆资产链路,不是人脸嵌入校验,最终观感取决于立绘质量与提示词是否守规矩

猫斯卡的定位是可规模化生产的 AI 短剧操作系统——把专业流程固化进产品,而不是宣称无需人类、零失误出片。

数字剧组适合谁

如果你已经在做短剧、最痛的是「每集都像不同人写的、每个镜头人物都在变脸」,这种按岗位拆分的编制比一个全能对话框更对症。它的价值不在某个岗位多惊艳,而在顺序不被跳步、交接物不被丢失、记忆不靠模型心情

如果你只想快速试一个点子、不在乎连续性和一致性,完整的剧组编制反而是负担——那种场景用轻量工具更合适。工具要匹配生产阶段,而不是反过来。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com