同样是“女主走进大殿”,有人生成出来像普通进场,有人做出来却有压迫感、宿命感,甚至能让观众提前感觉到危险。
区别往往藏在镜头里。
平视标准镜头,会让这场戏显得真实、克制;低机位仰拍加中长焦,人物会更强势;高机位俯拍加长焦,人物又会显得孤立、渺小。
剧情没有变,镜头选择一换,观众接收到的情绪已经完全不同。
很多提示词会写“电影感”“高级感”“压迫感”,却没有告诉 AI:摄影机站在哪里,用什么角度看人物,画面该靠近还是远离,人物与环境是什么关系。
所以我整理了一套镜头语言与情绪编码速查方法。
以后写分镜或 AI 视频提示词,可以先确定要让观众感受到什么,再反推镜头怎么选。
把“我想要某种感觉”,变成 AI 可以看见和执行的画面条件。
第一步:先分清镜头语言的三个维度
写镜头时,很多人会把“广角、俯拍、主观视角”放在一起比较。
它们其实控制着不同的东西。
1. 焦距与光学效果
这一层决定空间看起来有多远、人物与背景是什么关系,以及画面有没有透视拉伸或空间压缩。
常用镜头有:
广角镜头; 标准镜头; 中长焦人像镜头; 长焦或超长焦镜头; 鱼眼镜头; 微距镜头; 移轴镜头。
2. 机位高度与画面角度
这一层决定摄影机从什么位置看人物。
常用角度有:
俯拍; 仰拍; 平视; 荷兰角。
3. 叙事视点与人物关系
这一层决定观众站在谁的位置上,以及观众与角色保持什么关系。
常用视点有:
过肩镜头; 主观镜头。
一条完整的镜头提示词,可以从这三个维度各选一个,再继续补充景别、构图、景深和运镜。
我现在常用的公式是:
叙事视点 + 机位角度 + 焦段或镜头类型 + 景别 + 相机距离 + 构图 + 景深 + 运镜 + 情绪目的 + 画质描述
比如:
第三人称视角,低机位仰拍,85mm 中长焦镜头,人物中近景,主体居中构图,浅景深,背景明显压缩,镜头缓慢向前推进,强化人物的威严、力量感和危险气场,电影级光影,8K 超高清细节。
这段话里,每个词都有明确任务。
“低机位仰拍”负责人物气势,“85mm 中长焦”负责压缩背景并聚焦人物,“浅景深”负责隔离环境,“缓慢推进”负责让压力逐渐靠近观众。
第二步:根据情绪目标反推镜头
实际写提示词时,可以先问一句:
这一镜,我最希望观众感受到什么?
先只选一个主要情绪,再决定镜头。
1. 想要压迫感和临场感
适合使用主观视角、广角镜头、近距离构图和快速手持推进。
主观视角,24mm 广角镜头,人物眼睛高度,穿过昏暗狭窄的走廊,近距离构图,背景产生明显透视拉伸,手持镜头快速向前推进,视线紧张地扫过两侧房门,营造被追踪般的紧迫感与压迫感,电影级光影,8K 超高清细节。
广角会把近处物体放大,把远处空间拉长。走廊、门框和墙面一起向人物挤压,观众很容易被卷入现场。
2. 想要强势人物登场
适合使用低机位仰拍、中长焦、居中构图和缓慢推进。
第三人称视角,低机位仰拍,85mm 中长焦镜头,人物中近景,主体居中构图,浅景深,背景被明显压缩,镜头缓慢向前推进,强化人物的威严、力量感和危险气场,电影级光影,8K 超高清细节。
这里最容易出问题的是仰拍角度过大。
机位太低,人物下巴、鼻孔和脸部比例容易变形。写成“轻微低机位仰拍”或“摄影机位于人物胸口高度向上拍摄”,通常会更稳定。
3. 想要孤独感和宿命感
适合使用高机位俯拍、长焦、超远景、大面积留白和缓慢跟随。
第三人称视角,高机位俯拍,超远景,长焦镜头,一名人物独自行走在辽阔雪原中,人物被压缩在画面中央,大面积留白,镜头缓慢跟随,营造孤立、渺小和不可抗拒的宿命感,冷峻电影色调,8K 超高清细节。
俯拍负责削弱人物力量,超远景负责扩大环境,长焦负责压缩空间。三者组合后,人物会像被困在命运里。
如果想要更强的“上帝视角”,可以直接写高空垂直顶拍。只写“俯拍”,模型给出的角度可能不够高。
4. 想要失衡感和危险临近
适合使用荷兰角、倾斜地平线、缓慢环绕和轻微逼近。
第三人称视角,中近景,荷兰角倾斜构图,标准镜头,人物站在昏暗房间中央,画面向右倾斜约 15 度,地平线明显失衡,镜头缓慢环绕并轻微逼近,营造精神混乱和危险逐渐靠近的不安感,电影级光影,8K 超高清细节。
荷兰角最好写清倾斜方向和程度。
轻微倾斜适合潜在不安,角度越大,眩晕和失控感越强。每一镜都倾斜会让观众很快疲劳,放在情绪转折点更有效。
第三步:把抽象情绪改成可观察的画面
很多提示词会这样写:
女主很孤独,画面压抑,充满宿命感,电影感运镜。
“孤独”“压抑”“宿命感”都属于结果,AI 还缺少制造结果的画面条件。
可以改成:
高机位俯拍,长焦超远景,女主独自站在空旷宫殿中央,周围没有其他人物,人物只占画面约十分之一,大面积冷色地面形成留白,镜头缓慢向后拉远,宫门阴影逐渐覆盖她的身体。
这里没有反复堆叠情绪词,观众依然能感受到人物的孤立和无助。
我会特别检查四点:
人物在画面里有多大; 摄影机比人物高还是低; 环境被拉伸、压缩还是虚化; 镜头最后向人物靠近还是远离。
把这四点写清楚,情绪通常会稳定很多。
第四步:先做一份三段式镜头脚本
下面用一个 10 秒的 AI 漫剧片段演示。
剧情很简单:女主独自走进大殿,权臣拦住她,她抬眼亮出密诏,重新拿回主动权。
这三段情绪依次是:孤立、对峙、反击。
生成分镜后,重点检查镜头之间有没有完成情绪变化。
第一镜要让人物被大空间压住,第二镜要建立两人的位置关系,第三镜再用低机位和推进把力量交回女主。
如果三镜都用人物近景,剧情信息还在,情绪层次会变平。
第五步:把分镜变成完整视频提示词
有了三段式分镜,再把视点、角度、焦段、人物动作和尾帧写进时间轴。
生成一个 10 秒竖屏古装 AI 漫剧视频,严格遵循三段式分镜顺序,精致国漫风,电影级光影,人物面部稳定,无 BGM。0-3 秒:高机位俯拍,长焦超远景。空旷大殿内,穿黑色古装的女主从大殿门口独自向中央走来,人物只占画面约十分之一,大面积冷色地面留白。镜头缓慢向后移动并轻微升高,强化人物孤立、渺小和被审视的处境。3-7 秒:切到红衣权臣的过肩镜头,平视标准镜头,中景。权臣肩膀位于画面左侧前景并轻微虚化,女主站在画面右侧中景,二人隔着三步距离。权臣向前迈出半步挡住去路,女主停下。焦点始终保持在女主脸上,镜头稳定停留,建立对峙关系。7-10 秒:切到女主轻微低机位仰拍的 85mm 中长焦中近景。女主从袖中展开密诏,随后缓慢抬眼看向画面左侧的权臣。镜头物理缓慢推近,背景进入浅景深虚化。尾帧稳定停在女主冷静的正面目光和展开的密诏上,强化她重新拿回主动权的力量感。声音:保留大殿内空旷脚步回声、衣料摩擦声、纸张展开声和极轻的环境风声。限制:无字幕、无水印、无镜头乱晃;女主服装、发型和五官不变化;权臣保持红色朝服;人物左右位置不交换;密诏不消失;动作不瞬移。
这段提示词的重点是让镜头语言跟着人物处境变化。
第一段用俯拍和超远景削弱人物,第二段用平视过肩镜头建立对峙,第三段用仰拍和中长焦把力量集中到女主身上。
观众即使关掉声音,也能从镜头变化里看懂谁正在失去主动,谁又把局面扳了回来。
这里最容易出问题的 5 种写法
第一,只写镜头名称,没有写镜头目的。
“85mm 中长焦”后面可以补一句“压缩背景,让所有注意力集中到人物表情”。
第二,一条提示词塞进太多情绪。
同一镜同时要宏大、亲密、混乱、平静,镜头选择会互相冲突。每一镜先保留一个主要情绪。
第三,只写俯拍或仰拍,没有写机位高度。
可以补充“摄影机位于人物胸口高度”“高空垂直顶拍”或“高机位约 45 度俯拍”。
第四,过肩镜头没有人物位置。
要写清谁在前景、谁是焦点、双方分别位于画面哪一侧。
第五,主观镜头没有说明是谁的眼睛。
可以写成:
镜头代表女主第一人称视角,她正在穿过狭窄走廊,看向尽头半掩的房门。
视点、动作对象和视线方向同时写清,主观镜头才会稳定。
这套方法还可以怎么改?
替换人物和场景时,保留“情绪目标—镜头组合—可见画面”这条路线。
英雄登场:低机位仰拍 + 中长焦 + 居中构图 + 缓慢推进。
受害者被监视:高机位俯拍 + 长焦 + 遮挡式构图 + 远距离跟随。
恐怖追逐:主观视角 + 广角 + 近距离构图 + 手持快速推进。
暧昧对视:平视 + 中长焦人像镜头 + 浅景深 + 缓慢靠近。
精神崩溃:荷兰角 + 标准镜头 + 倾斜地平线 + 缓慢环绕逼近。
城市众生:移轴镜头 + 高机位俯拍 + 快节奏延时 + 模型化现实。
同一种情绪也可以换镜头表达。
压迫感可以来自广角近距离拉伸,也可以来自长焦远距离窥视。前者让观众被卷进现场,后者让观众感觉人物逃不出监视。
先想清楚观众站在哪里,再决定使用哪一种。
第六步:记住 13 种镜头的情绪倾向
看完前面的示例,再用下面这张表做快速判断。
镜头没有固定答案,但每种镜头都有比较常见的视觉倾向。
这张表可以用来选方向,最终效果还要结合剧情语境。
比如仰拍既可以拍英雄,也可以拍反派。镜头提供力量感,人物身份、表情、光线和声音决定这股力量让人敬佩还是恐惧。
最后总结一下
写 AI 视频镜头语言,真正要交代清楚的是:
观众站在谁的视角; 摄影机比人物高还是低; 使用什么焦段或特殊镜头; 人物在画面里有多大; 主体与背景是拉伸、压缩还是虚化; 镜头向什么方向、以什么速度移动; 这一镜要让观众感受到什么; 尾帧停在什么人物关系和构图上。
最后记住这条公式:
叙事视点 + 机位角度 + 焦段或镜头类型 + 景别 + 相机距离 + 构图 + 景深 + 运镜 + 情绪目的 + 画质描述
先确定情绪,再选择镜头;把每个抽象感觉翻译成可观察的机位、距离、构图和运动,AI 才更容易生成真正有叙事作用的镜头。
夜雨聆风