夜雨聆风学习资料网

ARTICLE · 1128541

AI短剧老是穿帮?把"站位"和"道具"管死,镜头就不跳了

AI短剧老是穿帮?把"站位"和"道具"管死,镜头就不跳了

角色不换脸、镜头不跳位 · 第 2 篇

做过 AI 短剧的人,几乎都撞过同一个画面:前一镜女主站在桌子左边,手里攥着文件夹;下一镜切过去,人飘到了右边,手里的文件夹还变成了一个杯子。观众看得一头雾水,你自己回看也一头雾水。

这真不是某个工具不好用,而是 AI 视频生成的天性使然——每一次生成都是一次独立调用,模型不会"记得"上一镜谁站在哪。角色在相邻镜头里跳站位、道具凭空冒出来又消失,就是 AI 短剧最高频的穿帮来源。

这篇就把这件事理清楚。整套方法归结为两个词:站位锁定和道具稳定。

成片关键帧:角色与空间的一致,靠的是生成前就锁死,而不是生成后靠运气

一、先弄明白穿帮是怎么来的

在讲怎么解决之前,得先知道它为什么发生。

传统剧组怎么拍?演员走位、道具摆放、灯的位置,在同一次拍摄里是不动的。剪辑师要做的,只是把不同机位的素材按时间顺序接起来。可 AI 生成完全是另一回事——每一个分镜都是单独生成的一段视频,模型根本不了解上一镜里角色站在哪、手里拿着什么、光从哪个方向打过来。

有人做过实测:同一个场景连做 3 个分镜,空间元素的位置匹配度平均只有 53%——差不多每两镜的接缝处就有一处肉眼可见的错位。五官飘移、色温断层、姿态跳变、道具换手,这些毛病背后是同一个病根:分段独立生成再硬拼的思路,天生缺一个跨镜头的约束。

那解法是什么?不是把提示词写得更长,而是把"空间信息"和"道具状态"变成能引用、能核对的结构化数据,让每一镜都从同一个基准出发。

连镜断裂的三个根源:站位漂移、道具变魔术、五官漂移

二、站位锁定:把角色"钉"在画面里

### 2.1 先做一张空间基准帧

站位锁定的头一步,是给每个场景做一张"空间基准帧"。

什么叫空间基准帧?说白了就是一张静止图,把"谁站哪、面朝哪、在画面什么位置、家具和光源在哪、摄影机从哪个角度拍"这些信息,全部画进一张图里。这张图做完,就当成 `scene-ref` 反复挂到该场景的每一个镜头上。

具体分两步走:

第一步,写"空间圣经"。先把四项信息填清楚:地标(家具、出入口的位置)、光源(方向、色温、有没有动态)、角色初始站位(谁站哪、朝哪)、固定机位(4-5 个机位的位置和角度)。

第二步,写基准帧提示词。把上面这些信息套进提示词模板,生成一张初始空间图。它相当于整场戏的"空间宪法",后面所有镜头都得跟它对齐。

有两条原则一定要守住:

• 新场景必须新建基准帧。剧情切到新房间、空间关系大变(比如从台阶上对峙换到平地)、有新角色进画面,都得重新做一张。

• 有现成的可以先用。要是上一镜的尾帧能精确表达空间关系,也可以临时当基准帧用,不过专门生成的更稳。

空间基准帧的四个要素:地标、光源、角色初始站位、固定机位

空间基准帧长这样:一张空景先把地标(窗 / 桌 / 门)、光源、机位钉死,后面每镜都挂它

### 2.2 镜间衔接锁:每一镜都从上一镜接过来

有了基准帧,真正让镜头"无缝"的关键在镜间衔接锁。

规则就一句:同组内的相邻镜头,必须继承上一镜结束时的人物位置、姿态、手部落点、持物、道具落点和视线方向。

拿个具体场景说。镜头 A:女主站在办公桌左侧,右手拿着文件夹,视线看向画面右侧的门。那么镜头 B 的开场就必须从这儿起步——她还在左侧,右手还拿着文件夹,视线还朝向右侧。除非剧本明文写了"她走到桌子右边"或"她把文件夹放到桌上",否则不许变。

写提示词时,这一条要显式写出来,比如:

[SPATIAL ANCHOR] 参照附图场景基准帧。女主位于画面左侧约1/3处,面朝screen-right,右手持文件夹,文件夹位于腰部高度。背景中窗户位于画面后景偏左位置。

这里有个特别实用的小工具,叫"空间账本":每写完一镜,就记一笔——人是坐着还是站着、手停在哪、道具落在哪、视线看向谁。下一镜直接从这个账本读取起点状态。

镜间衔接锁:下一镜必须继承上一镜的人物位置、姿态、手部落点、持物、视线

### 2.3 机位可以换,人物状态不能凭空跳

还有一条特别容易被忽略:摄影机的锚点可以动,人物的锚点不能没来由地变。

什么意思?你可以正面拍女主,也可以切侧面、甚至从背后拍,机位是自由的。但人物本身的状态不能无缘无故地跳——从蹲到站、从站到坐、从桌前到门口、转身或离场,每一步都得写出看得见的动作过程。

比如,你不能镜头 A 让她蹲着捡东西,镜头 B 突然就坐着喝茶。中间必须有"她站起身,走到椅子旁,坐下"这样的过渡。这不是为了画面好看,是为了给 AI 足够的信息,它才能生成连贯的动作。

提示词里的空间锚点写法:这一行显式写出来,跨镜衔接才稳

三、道具稳定:别让东西"变魔术"

道具是 AI 短剧的另一个高频穿帮点。文件突然换手、杯子凭空出现、手机从右手跳到左手、打火机变成烟盒——在观众眼里全是硬伤。

解决思路只有一条:把每个道具当成一个有"状态"的对象去管理。

### 3.1 道具连续性,盯住三件事

关键道具在相邻镜头之间,必须保持这三件事连着:

第一,归属不变。东西在谁手里、放在哪。镜头 A 结束时文件夹在女主右手,镜头 B 开头就不能出现在男主手里,除非中间有"递交"的动作镜头。

第二,朝向不变。道具正面朝哪、开口朝哪、哪一面对着镜头。这个细节最容易被漏掉,可道具突然翻个面,在画面里特别扎眼。

第三,状态不变。完好还是损坏、干的还是湿的、打开的还合上的、亮着的还是熄灭的。这些状态要是变了,就必须在镜头里把变化过程演出来。

### 3.2 一张道具状态表,一镜填一格

实操上,建议用一张简单的状态追踪表来管。每个要跨镜头出现的道具,每拍完一镜就记录它的状态:

镜头
道具
持有者
所在位置
朝向
状态
S03
文件夹
女主
右手持,腰部高度
正面朝镜头
合上
S04
文件夹
女主
桌面中央
正面朝上
合上
S05
文件夹
男主
双手持,胸前
正面朝镜头
打开

这张表里,S03 到 S04 之所以变,是因为剧本里有"放置"这个动作;S04 到 S05 之所以变,是因为有"递交并打开"的动作。凡是找不到对应动作的变化,都是穿帮。

道具状态追踪表示例:一个道具一行,写完一镜填一格

### 3.3 冻结关键帧:只写起点看得见的

写每一镜提示词时守一个原则:冻结关键帧只写起点那一瞬间能看见的东西,终点才出现的道具状态一律不写。

举例:女主在镜头开头手里拿着文件夹,镜头结束时她把文件夹放到了桌上——那么冻结关键帧里只写"女主右手持文件夹",不写"文件夹在桌上"。后者是结束状态,留到收尾关键帧里再写。

这么写的好处是,AI 生成每一帧时都有一个明确的空间参照,不会因为提示词里同时冒出两个位置而犯迷糊。

四、两个实战案例

理论讲完,看两个常见场景怎么落。

### 案例一:办公室对峙

场景:女主和男主在办公室对峙,女主站在办公桌左侧,男主站在右侧门口。

第 1 步,写空间圣经:办公桌在画面中央偏下,窗户在后景偏左,门在画面右侧。女主初始站位在桌左侧(screen-left),面朝 screen-right;男主在门口(screen-right),面朝 screen-left。固定机位:A 机正面全景,B 机在女主侧后方,C 机在男主侧前方。

第 2 步,生成空间基准帧:把上面的信息写成提示词,生成一张俯视角度或正面全景的初始空间图。

第 3 步,逐镜写提示词:

• 镜头 1(全景):参照基准帧,女主站桌左侧,男主站门口,两人对视。女主右手拿一份文件。

• 镜头 2(女主近景):女主仍在画面左侧,面朝 screen-right,右手持文件,文件在胸前高度。背景里窗户仍在后景偏左。

• 镜头 3(男主近景):男主仍在画面右侧,面朝 screen-left,视线看向画面左侧。背景里门口的门框压在画面右边缘。

注意:镜头 2、镜头 3 虽然各自只拍了单人,但站位、视线方向和背景锚点都得跟基准帧一致。男主的视线依然朝向 screen-left,因为对面就是站在左侧的女主。

案例:办公室对峙的空间布局,基准帧定死站位、朝向、机位

同一场对峙拍出来是这样:女主在左、男主在右、桌子居中,窗在后景偏左、门在右侧(成片感)

### 案例二:街头追逐后停下

场景:男主在街头跑了一段后停在巷口,弯腰喘气,手里拿着一封信。

这个案例的难点在运动之后的状态衔接。前一镜是跑,后一镜是停,要是直接切到"停下",AI 很可能给你一个跟前面毫无关系的姿态。

解法:在跑动镜头的收尾关键帧里,就把"减速停下"的过渡写出来。比如收尾帧提示词写:"男主从画面右侧跑向左侧,速度减慢,身体前倾,右手持信件,即将停在巷口前。"

然后下一镜的冻结关键帧从这儿接:"男主站在巷口左侧,身体微弯,双手撑在膝盖上,信件仍在右手中。"这样两镜的状态就接上了。

五、拼接前必查的 5 个点

在把镜头拼成片之前,逐条过一遍:

1. 角色站位:相邻两镜里,同一角色在画面中的位置(左/中/右)、朝向、挡不挡背景元素,一致吗?

2. 视线方向:A 看 B 的镜头里,A 的视线朝向跟 B 的位置对得上吗?正反打里,两人的视线有没有形成对视?

3. 道具连续性:关键道具的持有者、位置、朝向、状态,跟上一镜接得上吗?有没有凭空出现、消失或换手?

4. 动作衔接:上一镜结束时人物的动作终点,等于下一镜开始时的动作起点吗?有没有突然跳变?

5. 光线一致性:同一场景内的色温、光源方向、阴影方向,统一吗?

拼接前必查的 5 个点:站位、视线、道具、动作、光线

六、挂到 WorkBuddy 工作台上怎么落地

10/3 那篇我在 WorkBuddy 里装好了 7 个 AI 视频 skill,这一篇的方法可以直接挂上去用:

• 空间基准帧就是你的场景资产,一个场景一张,存进项目目录,后面所有镜头引用它——跟 10/3 那个思路一致:素材集中管、镜头统一引用,不要每集重新抽卡。

• 空间账本、道具状态表直接建成两张表,一个场景一行、一个道具一行,写完一镜填一格。这比靠脑子记靠谱得多——系列剧做到第 8 集,你不可能还记得第 2 集那份文件夹在谁手里。

• 冻结关键帧写法就是提示词的写法:只写起点看得见的,终点状态留给收尾帧。这一条能直接砍掉"文件夹凭空出现在桌上"这类穿帮。

工具层面:基准帧和角色定妆图用豆包 Seedance 或即梦生成(豆包 Seedance 2.0 图生视频 4–15 秒、最短 4 秒起,最新的 Seedance 2.5 单次最长到 30 秒;官方接入常见 720p 档);即梦生图好用,但免费档别死等,实测排两三天才出一条 5 秒。

写在最后

AI 短剧的"无缝连镜",说到底是个工程问题,不是创意问题。提示词写得再华丽,也治不了空间漂移;后期一帧帧修图,也只是治标。

正确的做法是:在生成之前,就把空间信息和道具状态变成结构化、可引用的数据。空间基准帧管站位,空间账本管交接,道具状态表管连续性——这套流程立起来之后,你的 AI 短剧才能从"抽卡碰运气"变成"稳定能交付"。

有什么踩过的坑或者好用的技巧,欢迎在评论区交流。

我是「AI灵感反应堆」每天拆一个能直接抄的AI创作玩法。实战问题随时评论区见。

👉 你被哪个穿帮坑过?评论区说场景,我下期单独拆解怎么修。

相关学习资料