English

不用再买 AI 视频提示词模板了,我把一条真正出过片的全文摊开,逐段告诉你哪句管什么

猫斯卡编辑部 | 最后更新日期

本篇用到的完整提示词

《不用再买 AI 视频提示词模板了,我把一条真正出…》· 共 2 条,由猫斯卡自动生成,可直接复制取用。

1. 悬笔(Seedance 2.0 Fast)
整体设定为晚唐深宫画眉偏殿妆台夜戏,悬疑追查低照氛围,主色深青、辅色冷蓝灰与雾青,关键光为琥珀橙烛火,冷暖分离。将 @图片1 中的画眉偏殿妆台夜景(铜镜、妆奁、烛台陈设)定义为 <场景1>;将 @图片2 中的沈眉定义为 <主体1>,音色为中低声区、清透偏冷、咬字平稳的二十余岁女声;将 @图片3 中的柳才人定义为 <主体2>,音色为中高声区偏软、声线细弱的少女女声。 镜头1:极缓推进(slow creep-in, dolly in),起幅:螺子黛笔尖的大特写,墨色笔锋悬于半空 → 落幅:近景,笔尖正对着 <主体2> 弯起的眉骨,<主体2> 坐于 <场景1> 妆台前,<主体1> 持笔的手稳悬在 <主体2> 眉前半寸处,<主体1> 指尖稳得纹丝不动,手腕平直不晃,肩背端正;<主体2> 肩背绷得发紧,微微缩肩,呼吸放得极轻,眼睫垂着不敢颤动,唯一动机光源为妆台烛火,琥珀橙硬光自侧前方斜打在笔锋与 <主体2> 眉骨受光面,光比 6:1,背景与暗部压入深青冷调,暗部保留炭黑细节不撞底,空气中浮着细尘在烛火暖光里缓慢翻涌,烛火轻微跳动使暖光在笔锋与眉骨上微微摇曳,背景冷暗里铜镜映着一点跳荡的烛影,<烛火细微噼啪声,殿外远处更漏声,两人极轻的呼吸声>。 电影胶片质感,变形宽银幕镜头,青橙分级,硬光动机光源,暗部保留细节,35mm胶片颗粒,自然运动模糊,高清,细节丰富,电影质感,硬光大光比,青橙分级,低饱和,画面铺满无黑边,shot on ARRI Alexa 65,Panavision anamorphic lens,85mm portrait lens,shallow depth of field,oval bokeh,halation around highlights,filmic highlight rolloff,lifted film blacks,180 degree shutter with natural motion blur,teal and orange color grade,DCI-P3,no letterbox,人物面部稳定不变形、五官清晰、动作连贯自然,不僵硬,无穿模无卡顿,保持无字幕,避免生成任何文字或字幕,不要生成水印,不要生成 Logo,视频全程禁止出现外形、着装、配饰完全一致的人物,禁止生成同款分身、双胞胎效果,同一画面中仅保留单个对应人物,不出现人物重复复刻。
2. 开口(Seedance 2.0 Fast)
整体设定为晚唐深宫画眉偏殿妆台夜戏,悬疑追查低照氛围,主色深青、辅色冷蓝灰与雾青,关键光为烛火琥珀橙,冷暖分离。将 @图片1 中的沈眉当值的画眉偏殿妆台(梳妆台上仅一面铜镜,无其他多余镜子)定义为 <场景1>;将 @图片2 中的沈眉定义为 <主体1>,音色为中低声区、清透偏冷、咬字平稳的二十余岁女声;将 @图片3 中的柳才人定义为 <主体2>,音色为中高声区偏软、声线细弱的少女女声。 镜头1:焦点转移(rack focus, focus pull),起幅:梳妆台上铜镜的近景特写,镜中映着跳荡的烛火与 <主体2> 垂着的眼 → 落幅:中景,<主体2> 坐在 <场景1> 的妆台前,<主体1> 立于妆台侧后方持画眉笔,<主体2> 坐在妆凳上,肩背微微绷紧,垂着眼帘,声音压得发颤,用中高声区偏软、声线细弱的少女女声说道 {劳烦沈女官,给我画个……不像自己的眉},说话时指尖按在左侧袖口处,指节因用力而泛白,呼吸轻浅发颤;<主体1> 没有应声,目光平稳扫过 <主体2> 按在袖口的手,持笔的手腕稳得不晃,眉峰微敛,情绪克制。低照度硬光,唯一动机光源为妆台上的烛火,光比6:1,烛火暖橙光打在人物面部受光面与眉笔笔锋上,环境与暗部压向深青冷调,暗部保留细节无死黑;空气中浮着细尘在烛火光柱里缓缓翻涌,烛火跳荡使铜镜里的光影与人物影子在妆台面上轻轻晃动,湿冷的殿内空气带着微尘质感。音频:烛火轻微的噼啪声、殿外远处隐约的夜风、<主体2> 压得发颤的气声台词、衣料轻微摩擦声。 电影胶片质感,变形宽银幕镜头,青橙分级,硬光动机光源,暗部保留细节,35mm胶片颗粒,自然运动模糊,高清,细节丰富,电影质感,硬光大光比,低饱和,画面铺满无黑边,人物面部稳定不变形、五官清晰、动作连贯自然,不僵硬,无穿模无卡顿,保持无字幕,避免生成任何文字或字幕,不要生成水印,不要生成 Logo,视频全程禁止出现外形、着装、配饰完全一致的人物,禁止生成同款分身、双胞胎效果,梳妆台上仅保留场景图中的那一面铜镜,不生成任何其他多余镜子。

1864 个字,没有一句「氛围感」「电影感大片质感」,演技和光全是写出来的

先看两条片子。

Seedance 2.0 Fast,成片 12.1 秒
Seedance 2.0 Fast,成片 15.1 秒,接着上一条演

这是一部叫《深宫画眉人》的晚唐宫廷剧。

女主沈眉是宫里最好的画眉女官。宫里传一句话:她替谁画了眉,谁那晚就见得着圣颜。

上面两条是第 1 集同一场戏,「沈眉当值的画眉偏殿妆台 · 夜」的前后两个镜头。一个低位嫔御柳才人深夜找上门,请她画一双不像自己的眉。

一间屋、一支蜡烛、两个人、一支笔。

没有大场面可以糊弄,全靠脸上和手上,这种戏最容易翻车。

这两条是一次生成的,没抽卡。

沈眉。宫里最好的画眉女官
沈眉。宫里最好的画眉女官
柳才人。深夜来求画眉的那位
柳才人。深夜来求画眉的那位
画眉偏殿的妆台。戏就在这儿,两条片子都没离开过这张台子
画眉偏殿的妆台。戏就在这儿,两条片子都没离开过这张台子
偏殿外廊
偏殿外廊

开拍之前,这部戏的人和景都是这么一件件先定死的。

晚翠
晚翠
柳才人的另一版设定
柳才人的另一版设定
妆台的另一版设定
妆台的另一版设定

好家伙,咱最服的是演技这一层。

柳才人那个绷着的肩、不敢抬的眼,沈眉那个不接话的停顿,全都在,节奏也没赶。你不能说它一点破绽没有,暗光底下手部细节历来是这批模型的老毛病,但整体是电影的味道,不是那种一眼就能认出来的 AI 味。

这两条的提示词,一条 1010 个字,一条 854 个字,加起来 1864 字。都是猫斯卡(www.maosika.com)读完这一场戏之后自己写的。

全文太长,贴正文里这篇就没法看了。所以放在后台:给公众号发私信「1002」,两条 1864 个字一字不删,完完整整发给你。

这 1864 个字里,一句「氛围感」都没有

我扒开数了一遍,这两条一千八百多个字里,没有出现过下面任何一个词:氛围感、高级感、电影感大片质感、表情紧张、神色复杂、演技炸裂。

一个都没有。这几个词恰恰是咱自己写提示词时用得最顺手的那几个。。。

而演技和电影感这两样,恰恰是它做得最好的。它们是被写出来的,只是写成了另一种东西。

下面逐段拆,大伙儿跟着往下看,哪句在管什么,一句一句指给你。

管演技的,全是身体动作

先看柳才人紧张这件事,提示词是这么写的:

<主体2> 肩背绷得发紧,微微缩肩,呼吸放得极轻,眼睫垂着不敢颤动

再看她开口那一句:

说话时指尖按在左侧袖口处,指节因用力而泛白,呼吸轻浅发颤

你数数,一个情绪形容词都没有。肩、呼吸、眼睫、指尖、指节,全是摄影机拍得到的东西,一样一样都能落到画面上。

咱平时怎么写?大概率是「柳才人神情紧张,欲言又止」这么一句。这话模型接不住,它不知道紧张长什么样,最后就给你一张皱着眉的脸,剩下十几秒站着不动。

规矩是:情绪不许直接写,你得先在脑子里把这场戏演一遍,再把演出来的那几样落到纸上。

这一条听着简单,真做起来最费脑子,因为它逼着你把「我想要一个紧张的女人」翻译成「肩、呼吸、眼睫、指尖分别在干嘛」。

「没有应声」也是表演

这一句我觉得最狠:

<主体1> 没有应声,目光平稳扫过 <主体2> 按在袖口的手,持笔的手腕稳得不晃,眉峰微敛,情绪克制

沈眉这一镜的表演,核心是她不说话

沉默在剧本里是一个括号,在提示词里必须写成动作,不然模型只会让她张嘴。这儿把沉默拆成了三件事:不接话、目光落在对方的手上、手腕不晃。

顺带一提,那个「目光扫过对方按在袖口的手」,把两个人的表演接上了:柳才人手在使劲,沈眉看见了。一句话里带着两个人的戏。

管电影感的,是光怎么打

这两条的画面为什么像电影,答案在这几句:

唯一动机光源为妆台烛火,琥珀橙硬光自侧前方斜打在笔锋与眉骨受光面,光比 6:1,背景与暗部压入深青冷调,暗部保留炭黑细节不撞底

三样东西,一样都不能少。

唯一动机光源:屋里只有一根蜡烛在发光,所有的光都得从它来。你不写这句,模型给你的是四面八方都亮的平光,一看就是棚拍。

光比 6:1:亮的地方和暗的地方差六倍。

这是个数字,不是形容词,模型接得住。

暗部不撞底:暗的地方不能黑成一团死墨,得还看得见东西。这一句是电影和便宜画面最直接的分界线。

咱要是只写「电影感、氛围感、大片质感」,模型能给的就是加个滤镜、压个暗角,看着挺唬人,一放大就露馅。

它不知道你要的是什么光,你得告诉它光从哪儿来、亮暗差多少、暗到什么程度为止。

声音也是写出来的,不是配上去的

这两条的声音不是后期贴的,是提示词里点名要的。写法是把音效装进尖括号:

<烛火细微噼啪声,殿外远处更漏声,两人极轻的呼吸声>

三样声音,各有各的活儿:烛火交代了唯一光源就在近处,更漏交代了这是深夜而且屋外很空,呼吸声把两个人的紧张贴到耳朵边上。

虽然环境声还谈不上多讲究,但这么写出来的声音是长在画面里的,不是后期硬贴上去的一层底噪,已经挺能打了。

第二条的音频那一句更细,直接把台词的气口也写进去了:

音频:烛火轻微的噼啪声、殿外远处隐约的夜风、<主体2> 压得发颤的气声台词、衣料轻微摩擦声

你别说,「压得发颤的气声」这六个字,比在提示词里写十遍「紧张」都管用,因为它同时管住了演技和声音两头。

顺带记个符号:台词用大括号 {},音效用尖括号 <>,这是官方定死的,别混着用。

管不出戏的,是照这一镜的风险现挂的

结尾那串兜底,多数人当成一条抄来抄去的固定尾巴。这两条里有一句,全网任何模板都不会有:

梳妆台上仅保留场景图中的那一面铜镜,不生成任何其他多余镜子

为什么会有这句?看一眼那张妆台设定图就懂了:铜镜后面是格子窗,边上还有反光的漆面,模型很容易顺手再生出一面镜子来。多一面镜子,这条就废了。

兜底不是抄的,是照着这一镜的具体风险现挂的。

同一场戏的前后两个镜头,兜底也不一样。第一条没挂这句,第二条挂了,因为第二条的构图正对着铜镜。

第一段在给每张图派活

回头说开头。这两条的第一段都是先派活:

将 @图片1 中的画眉偏殿妆台夜景(铜镜、妆奁、烛台陈设)定义为 <场景1>;将 @图片2 中的沈眉定义为 <主体1>,音色为中低声区、清透偏冷、咬字平稳的二十余岁女声

这张图管景、这张图管人,顺手把音色也定死。

注意它一个字都没描述沈眉长什么样。脸交给图,文字只管派活。你在这儿写「鹅蛋脸、大眼睛」,等于跟参考图抢方向盘。

一张能抄走的表

写提示词的时候,把要写的东西分成四堆,各写各的:

要什么该写成什么别写什么
演技肩、手、呼吸、眼睫、视线的具体动作紧张、忐忑、神色复杂
沉默不接话 + 眼睛看哪儿 + 手在干嘛沉默不语、欲言又止
电影感唯一动机光源 + 光比数字 + 暗部不撞底电影感、氛围感、大片质感
兜底照这一镜的具体风险挂,比如画面里有反光面就写死只留一面镜子抄一串固定尾巴
人物长相不写,交给参考图,只说这张图管谁鹅蛋脸、大眼睛、皮肤白皙

这张表不难记,说实话我第一次瞅见那条「不生成多余镜子」的时候,也没反应过来它是干嘛的。

难的是一部戏几百个镜头,每一条的光、每一条的兜底都得照那一镜重挂一遍。

开头那 1864 个字,就是猫斯卡(www.maosika.com)读完这一场戏、替这两个镜头各写了一遍的结果。这活儿本来就不该由人一条条去抠。

今天就能做的一件事:把你上一条 AI 视频的提示词翻出来,搜三个词。

搜「氛围感」,搜「电影感」,搜「紧张」。

搜到了,就把那句话删掉,换成这一镜里摄影机真正拍得到的那几样东西。这一条改完,比你再买十套模板管用。猫斯卡(www.maosika.com)也是照这个路子写的。

关于猫斯卡 | 猫斯卡 · 专业AI视频自动生产系统。把创意评估、剧本写作、人物场景道具定妆、镜头提示词与出片串成一条可审、可改、可回退的生产链。官网:www.maosika.com