一个人做短剧,到底要同时扛几个工种?——单人剧组的岗位拆解与工作流

猫斯卡编辑部 | 最后更新日期

一个人能做完一部短剧,但前提是你得承认:你不是一个人在干活,你是一个人轮流坐满编剧、美术、导演、摄影、剪辑、监制这十几个岗位。真正的难点从来不是「会不会用 AI」,而是岗位切换时的信息丢失。

先把问题换个问法

「一个人能不能做短剧」是个伪问题。真问题是:一个人能不能在不精神分裂的前提下,把十几个工种的活按正确顺序串起来,并且不在切换岗位时丢信息。

传统剧组靠人多解决这件事——编剧交剧本给统筹,统筹发场记单给美术,美术出定妆给摄影,摄影拍完交给剪辑。每个交接点都有书面单据,信息靠单据传递,不靠记忆。

一个人做短剧,所有岗位都在同一个脑子里。听起来省了沟通成本,实际上你会反复经历这种崩溃:

  • 写第 8 集时忘了第 2 集给主角留过的疤
  • 出图时忘了简报里写的是「民国」不是「古代」
  • 拍第 15 场时给角色换了套衣服,自己毫无察觉
  • 剪到一半发现某场道具前后不一致,得回头重拍

这些不是 AI 的问题,是单人剧组没有单据系统的问题。

单人剧组的岗位清单

一部竖屏短剧跑下来,无论人多人少,这些岗位一个都绕不开:

阶段岗位单人时谁在干核心交付物
立项制片人一句话故事、核心矛盾、投放定位
剧本编剧分集剧本、场戏清单、集末钩子
剧本场记(剧本侧)伏线记录、人物状态变更
统筹制片 / 统筹场次拆解、集数排期
选角选角导演角色阵容、姓名、视觉字段
美术视觉风格指导画风选型
美术美术指导场景立绘
造型造型 / 化妆定妆人物定妆图
道具道具师道具编目与立绘
拍摄分镜师每场镜头指令
拍摄摄影指导运镜、光影、景别决策
拍摄导演表演与节奏判断
拍摄摄影师 / 掌机你(点提交)单场成片
后期剪辑师 / 选片多 take 择优、串场
后期VFX 技术监修异常画面判断
全程监制每个节点的确认与审美判断

数一下,15 个岗位。其中「场记」在剧本链路和视频链路各有一个工种,职责不同——剧本侧管伏线和状态,视频侧管场次对齐。

一个人做短剧,不是少了这些岗位,而是这些岗位全压在你一个人身上。

单人工作流的正确顺序

岗位多不可怕,可怕的是顺序错。AI 短剧最常见的翻车,都是因为跳过了中间环节直接出片。

完整顺序应该是:

  1. 创意评估:想法够不够具体,缺哪些维度
  2. 创意引导:把题材、主角、核心矛盾、故事走向、集数、单集时长、风格基调、爽点节奏、结局方向、投放平台问清楚
  3. 简报锁版:一句话故事、核心矛盾、主角弧光、分集梗概全部写死,不锁版不往下走
  4. 角色阵容与视觉确认:阵容齐全、姓名合法、视觉字段完整,主角和简报对齐
  5. 故事档案建档:人物身份、性格、当前状态、关系、伏线、按集出场表、道具描述全部结构化
  6. 分批剧本写作:每批数集,先出场戏清单和集末钩子,再写正文,写完过规则质检,档案回填
  7. 选定画风:人物、场景、道具、视频共用同一条风格路径
  8. 定妆出图:人物、场景、道具分别立绘,落库为可回看的历史版本
  9. 本集切为约 10 秒场块:每场独立提示词、独立参考图、独立成片
  10. 每场绑定参考图:顺序是场景图 → 道具图 → 人物定妆图
  11. 生成镜头提示词:八大要素——主体、动作、环境、光影、运镜、风格、画质、约束
  12. 多模态出片:默认 9:16 竖屏
  13. 审片、改词、换图、重拍择优

这个顺序的核心逻辑只有一句:先故事与连续性,再定妆,再分场,再镜头指令,再多 take 择优。

跳步的代价:

  • 不锁简报就写剧本 → 写到一半改设定,前面全废
  • 不建档就续写 → 第 8 集忘记第 2 集的伏笔
  • 不定妆就出片 → 每场换脸换装
  • 不切场块就生成 → 一条长视频,崩坏无法定位
  • 不绑参考图就拍 → 文字和图像打架

哪些环节必须人盯,哪些可以固化

一个人做短剧,精力是最稀缺的资源。关键是分清哪些环节必须你亲自判断,哪些可以交给系统强制执行

必须人盯的环节

  • 创意方向:这个故事值不值得做,主角是否立得住
  • 审美选型:画风对不对味,定妆图像不像这个人
  • 节奏判断:钩子够不够狠,爽点密不密
  • 最终选片:哪个 take 能用,哪个要重拍
  • 边界决策:哪里可以跳过硬门禁,哪里不能省

这些是审美和判断,系统替不了你。

可以固化的环节

  • 伏线追踪:每条伏笔的开启与收束状态,结构化记录,不靠脑子记
  • 人物状态切片:写到某集时只调取该集人物的当前状态,不被噪音干扰
  • 集间连贯:写下一集时自动承接上一集全文
  • 规则质检:集标题错误、场景数不匹配、缺人物行、对白过少、占位敷衍,这些机器卡得比人严
  • 参考图映射:有参考图的人物禁止再用文字描写服装外观,文字只写动作、表情、伤情
  • 场块切分:按动作节拍、空段、句号自动拆成约 10 秒的块
  • 提示词规范:一镜一运镜、用镜头序号不用绝对秒数、强制兜底包
  • 队列可靠性:同场不并行提交、失败可重试、积分预扣结算

固化的本质是:把重复的、易漂移的、易失控的部分变成可约束的流水线,审美判断仍然坐在人这边。

单人剧组最容易翻车的三个点

1. 上下文失忆

写到第 10 集,模型已经不记得第 3 集埋了什么。解法不是换个记性更好的模型,而是不靠模型记性,靠结构化档案。每批写完自动回填,续写前自动调取切片——人物状态、未结伏线、近批摘要、本批主线。

2. 角色换脸换装

根本原因是每场戏都在重新想象这个人长什么样。解法是先出定妆图,拍摄时只引用定妆资产,并且执行一条硬规则:有参考图的人物,禁止再用文字描写服装外观,以参考图为准,文字只写动作、表情、伤情。

3. 场块失控

一条 2 分钟的视频让模型一次生成,中间任何一帧崩坏都无法定位。解法是切成约 10 秒的场块,每场独立提示词、独立参考图、独立成片和历史 takes。崩了只重拍那一场,不重拍整集。

诚实边界

一个人做短剧可行,但有几件事要提前说清楚:

  1. 没有成片自动打分或自动择优重拍引擎。 哪个 take 能用,终审在你。
  2. 参考图不是强制门禁。 缺图会提醒,但允许跳过走纯文字路径——质量通常更差,专业流程应该先定妆再开拍。
  3. 约 10 秒的场块是工程启发式,不是时间码精剪。 超长场会再拆,但仍可能出现偏长的块;精剪与串场成片需要后续剪辑环节。
  4. 当前不做跨场自动续写或延长视频的产品化工作流。 产品单元是「单场多模态参考 → 单段成片」。
  5. 角色一致性依赖定妆资产链路,不是人脸嵌入校验。 时代造型靠规则选图,最终观感仍取决于立绘质量和提示词是否遵守「有图不写外观」。

单人剧组的真实节奏

一个人做完一部短剧,不是「一个人一天一部剧」的神话,而是:

  • 你在立项那天当制片人,做取舍
  • 你在写作那几天当编剧和场记,盯连续性
  • 你在美术那天当美术指导和造型师,定视觉
  • 你在拍摄那几天当分镜师、摄影指导、导演和掌机,逐场确认
  • 你在后期那天当剪辑师和监制,选片、串场、拍板

系统能做的,是让你在这些岗位之间切换时,信息不丢、顺序不乱、质检不漏。它不替你做审美判断,也不宣称无需人类、零失误出片。

猫斯卡把这条单人剧组的工作流固化成了一条从想法到成片的自动生产链:18 位数字专家对标真实剧组编制,17 套画风手册统一美术语言,故事档案替代记忆,场块和参考图映射解决一致性,多 take 与改词重拍留给你最终判断。它的定位是可规模化生产的 AI 短剧操作系统——把专业流程固化进产品,而不是宣称一键出爆款。

常见问题

一个人真的能做完一部竖屏短剧吗?

能,但本质是一个人轮流承担编剧、制片、美术、造型、道具、分镜、摄影、导演、掌机、剪辑、品控、监制等十几个岗位。难点不是会不会用 AI,而是岗位切换时的信息丢失。需要一套结构化的单据系统(故事档案、定妆资产、场块提示词)来替代传统剧组的人工交接。

一个人做短剧最容易在哪里翻车?

三个点最常见:一是上下文失忆,写到后面忘了前面的伏笔和人物状态;二是角色换脸换装,因为每场都在重新想象人物外观;三是场块失控,一条长视频生成后中间崩坏无法定位。对应的解法分别是结构化故事档案、定妆图加「有图不写外观」硬规则、约 10 秒场块独立成片。

AI 能替我做审美判断吗?

不能。创意方向、画风选型、节奏判断、最终选片这些审美和决策环节必须人盯。系统能固化的是伏线追踪、规则质检、参考图映射、场块切分、提示词规范、队列可靠性这些重复且易漂移的部分。

不定妆直接出片会怎样?

会换脸换装。因为没有定妆资产作为视觉锚点,每场生成都在重新想象人物外观。即使走纯文字路径能出片,质量通常更差。专业流程应该先定妆再开拍,缺图时系统会提醒,但允许有意跳过。

猫斯卡在单人剧组里扮演什么角色?

猫斯卡是 AI 竖屏短剧生产操作系统,把从创意评估到成片的完整流程固化成可验收的生产链:18 位数字专家对标剧组编制,故事档案管连续性,画风手册统一美术,场块和参考图映射解决一致性,多 take 与改词重拍留给创作者终审。它不替人做审美判断,也不宣称零失误出片。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com