乐于分享
好东西不私藏

AI 视频镜头语言怎么选?我整理了 13 种镜头的情绪编码

AI 视频镜头语言怎么选?我整理了 13 种镜头的情绪编码
最近在做 AI 漫剧分镜时,我发现一个很常见的问题。

同样是“女主走进大殿”,有人生成出来像普通进场,有人做出来却有压迫感、宿命感,甚至能让观众提前感觉到危险。

区别往往藏在镜头里。

平视标准镜头,会让这场戏显得真实、克制;低机位仰拍加中长焦,人物会更强势;高机位俯拍加长焦,人物又会显得孤立、渺小。

剧情没有变,镜头选择一换,观众接收到的情绪已经完全不同。

很多提示词会写“电影感”“高级感”“压迫感”,却没有告诉 AI:摄影机站在哪里,用什么角度看人物,画面该靠近还是远离,人物与环境是什么关系。

所以我整理了一套镜头语言与情绪编码速查方法。

以后写分镜或 AI 视频提示词,可以先确定要让观众感受到什么,再反推镜头怎么选。

把“我想要某种感觉”,变成 AI 可以看见和执行的画面条件。

第一步:先分清镜头语言的三个维度

写镜头时,很多人会把“广角、俯拍、主观视角”放在一起比较。

它们其实控制着不同的东西。

1. 焦距与光学效果

这一层决定空间看起来有多远、人物与背景是什么关系,以及画面有没有透视拉伸或空间压缩。

常用镜头有:

  • 广角镜头;
  • 标准镜头;
  • 中长焦人像镜头;
  • 长焦或超长焦镜头;
  • 鱼眼镜头;
  • 微距镜头;
  • 移轴镜头。

2. 机位高度与画面角度

这一层决定摄影机从什么位置看人物。

常用角度有:

  • 俯拍;
  • 仰拍;
  • 平视;
  • 荷兰角。

3. 叙事视点与人物关系

这一层决定观众站在谁的位置上,以及观众与角色保持什么关系。

常用视点有:

  • 过肩镜头;
  • 主观镜头。

一条完整的镜头提示词,可以从这三个维度各选一个,再继续补充景别、构图、景深和运镜。

我现在常用的公式是:

叙事视点 + 机位角度 + 焦段或镜头类型 + 景别 + 相机距离 + 构图 + 景深 + 运镜 + 情绪目的 + 画质描述

比如:

已关注
关注
重播 分享
第三人称视角,低机位仰拍,85mm 中长焦镜头,人物中近景,主体居中构图,浅景深,背景明显压缩,镜头缓慢向前推进,强化人物的威严、力量感和危险气场,电影级光影,8K 超高清细节。

这段话里,每个词都有明确任务。

“低机位仰拍”负责人物气势,“85mm 中长焦”负责压缩背景并聚焦人物,“浅景深”负责隔离环境,“缓慢推进”负责让压力逐渐靠近观众。

第二步:根据情绪目标反推镜头

实际写提示词时,可以先问一句:

这一镜,我最希望观众感受到什么?

先只选一个主要情绪,再决定镜头。

1. 想要压迫感和临场感

适合使用主观视角、广角镜头、近距离构图和快速手持推进。

已关注
关注
重播 分享
主观视角,24mm 广角镜头,人物眼睛高度,穿过昏暗狭窄的走廊,近距离构图,背景产生明显透视拉伸,手持镜头快速向前推进,视线紧张地扫过两侧房门,营造被追踪般的紧迫感与压迫感,电影级光影,8K 超高清细节。

广角会把近处物体放大,把远处空间拉长。走廊、门框和墙面一起向人物挤压,观众很容易被卷入现场。

2. 想要强势人物登场

适合使用低机位仰拍、中长焦、居中构图和缓慢推进。

已关注
关注
重播 分享
第三人称视角,低机位仰拍,85mm 中长焦镜头,人物中近景,主体居中构图,浅景深,背景被明显压缩,镜头缓慢向前推进,强化人物的威严、力量感和危险气场,电影级光影,8K 超高清细节。

这里最容易出问题的是仰拍角度过大。

机位太低,人物下巴、鼻孔和脸部比例容易变形。写成“轻微低机位仰拍”或“摄影机位于人物胸口高度向上拍摄”,通常会更稳定。

3. 想要孤独感和宿命感

适合使用高机位俯拍、长焦、超远景、大面积留白和缓慢跟随。

已关注
关注
重播 分享
第三人称视角,高机位俯拍,超远景,长焦镜头,一名人物独自行走在辽阔雪原中,人物被压缩在画面中央,大面积留白,镜头缓慢跟随,营造孤立、渺小和不可抗拒的宿命感,冷峻电影色调,8K 超高清细节。

俯拍负责削弱人物力量,超远景负责扩大环境,长焦负责压缩空间。三者组合后,人物会像被困在命运里。

如果想要更强的“上帝视角”,可以直接写高空垂直顶拍。只写“俯拍”,模型给出的角度可能不够高。

4. 想要失衡感和危险临近

适合使用荷兰角、倾斜地平线、缓慢环绕和轻微逼近。

已关注
关注
重播 分享
第三人称视角,中近景,荷兰角倾斜构图,标准镜头,人物站在昏暗房间中央,画面向右倾斜约 15 度,地平线明显失衡,镜头缓慢环绕并轻微逼近,营造精神混乱和危险逐渐靠近的不安感,电影级光影,8K 超高清细节。

荷兰角最好写清倾斜方向和程度。

轻微倾斜适合潜在不安,角度越大,眩晕和失控感越强。每一镜都倾斜会让观众很快疲劳,放在情绪转折点更有效。

第三步:把抽象情绪改成可观察的画面

很多提示词会这样写:

女主很孤独,画面压抑,充满宿命感,电影感运镜。

“孤独”“压抑”“宿命感”都属于结果,AI 还缺少制造结果的画面条件。

可以改成:

已关注
关注
重播 分享
高机位俯拍,长焦超远景,女主独自站在空旷宫殿中央,周围没有其他人物,人物只占画面约十分之一,大面积冷色地面形成留白,镜头缓慢向后拉远,宫门阴影逐渐覆盖她的身体。

这里没有反复堆叠情绪词,观众依然能感受到人物的孤立和无助。

我会特别检查四点:

  1. 人物在画面里有多大;
  2. 摄影机比人物高还是低;
  3. 环境被拉伸、压缩还是虚化;
  4. 镜头最后向人物靠近还是远离。

把这四点写清楚,情绪通常会稳定很多。

第四步:先做一份三段式镜头脚本

下面用一个 10 秒的 AI 漫剧片段演示。

剧情很简单:女主独自走进大殿,权臣拦住她,她抬眼亮出密诏,重新拿回主动权。

这三段情绪依次是:孤立、对峙、反击。

生成分镜后,重点检查镜头之间有没有完成情绪变化。

第一镜要让人物被大空间压住,第二镜要建立两人的位置关系,第三镜再用低机位和推进把力量交回女主。

如果三镜都用人物近景,剧情信息还在,情绪层次会变平。

第五步:把分镜变成完整视频提示词

已关注
关注
重播 分享

有了三段式分镜,再把视点、角度、焦段、人物动作和尾帧写进时间轴。

生成一个 10 秒竖屏古装 AI 漫剧视频,严格遵循三段式分镜顺序,精致国漫风,电影级光影,人物面部稳定,无 BGM。0-3 秒:高机位俯拍,长焦超远景。空旷大殿内,穿黑色古装的女主从大殿门口独自向中央走来,人物只占画面约十分之一,大面积冷色地面留白。镜头缓慢向后移动并轻微升高,强化人物孤立、渺小和被审视的处境。3-7 秒:切到红衣权臣的过肩镜头,平视标准镜头,中景。权臣肩膀位于画面左侧前景并轻微虚化,女主站在画面右侧中景,二人隔着三步距离。权臣向前迈出半步挡住去路,女主停下。焦点始终保持在女主脸上,镜头稳定停留,建立对峙关系。7-10 秒:切到女主轻微低机位仰拍的 85mm 中长焦中近景。女主从袖中展开密诏,随后缓慢抬眼看向画面左侧的权臣。镜头物理缓慢推近,背景进入浅景深虚化。尾帧稳定停在女主冷静的正面目光和展开的密诏上,强化她重新拿回主动权的力量感。声音:保留大殿内空旷脚步回声、衣料摩擦声、纸张展开声和极轻的环境风声。限制:无字幕、无水印、无镜头乱晃;女主服装、发型和五官不变化;权臣保持红色朝服;人物左右位置不交换;密诏不消失;动作不瞬移。

这段提示词的重点是让镜头语言跟着人物处境变化。

第一段用俯拍和超远景削弱人物,第二段用平视过肩镜头建立对峙,第三段用仰拍和中长焦把力量集中到女主身上。

观众即使关掉声音,也能从镜头变化里看懂谁正在失去主动,谁又把局面扳了回来。

这里最容易出问题的 5 种写法

第一,只写镜头名称,没有写镜头目的。

“85mm 中长焦”后面可以补一句“压缩背景,让所有注意力集中到人物表情”。

第二,一条提示词塞进太多情绪。

同一镜同时要宏大、亲密、混乱、平静,镜头选择会互相冲突。每一镜先保留一个主要情绪。

第三,只写俯拍或仰拍,没有写机位高度。

可以补充“摄影机位于人物胸口高度”“高空垂直顶拍”或“高机位约 45 度俯拍”。

第四,过肩镜头没有人物位置。

要写清谁在前景、谁是焦点、双方分别位于画面哪一侧。

第五,主观镜头没有说明是谁的眼睛。

可以写成:

镜头代表女主第一人称视角,她正在穿过狭窄走廊,看向尽头半掩的房门。

视点、动作对象和视线方向同时写清,主观镜头才会稳定。

这套方法还可以怎么改?

替换人物和场景时,保留“情绪目标—镜头组合—可见画面”这条路线。

英雄登场:低机位仰拍 + 中长焦 + 居中构图 + 缓慢推进。
受害者被监视:高机位俯拍 + 长焦 + 遮挡式构图 + 远距离跟随。
恐怖追逐:主观视角 + 广角 + 近距离构图 + 手持快速推进。
暧昧对视:平视 + 中长焦人像镜头 + 浅景深 + 缓慢靠近。
精神崩溃:荷兰角 + 标准镜头 + 倾斜地平线 + 缓慢环绕逼近。
城市众生:移轴镜头 + 高机位俯拍 + 快节奏延时 + 模型化现实。

同一种情绪也可以换镜头表达。

压迫感可以来自广角近距离拉伸,也可以来自长焦远距离窥视。前者让观众被卷进现场,后者让观众感觉人物逃不出监视。

先想清楚观众站在哪里,再决定使用哪一种。

第六步:记住 13 种镜头的情绪倾向

看完前面的示例,再用下面这张表做快速判断。

镜头没有固定答案,但每种镜头都有比较常见的视觉倾向。

镜头
常见情绪
适合场景
广角镜头
压迫、卷入、临场、宏大、不安
狭窄走廊、近身打斗、史诗场面、第一人称追逐
标准镜头
真实、克制、平稳、信任、日常
双人对话、生活流、纪录片、家庭戏
中长焦人像镜头
凝视、亲密、暧昧、精致、被审视
人物特写、情感独白、明星写真、时尚画面
长焦或超长焦镜头
宿命、孤立、窥视、史诗、不可抗拒
雪原孤行、远距离跟踪、狙击视角、史诗结尾
鱼眼镜头
迷幻、超现实、混乱、青春、极限
梦境、精神幻觉、极限运动、嘻哈 MV
微距镜头
精致、私密、感官放大、被忽视的世界
眼泪、戒指、刀锋、美食、产品细节
移轴镜头
玩具感、抽离、童趣、模型化现实
城市缩微、节日活动、创意片头、轻快 MV
俯拍镜头
渺小、无助、被审视、宿命
巨大空间里的孤独人物、受害者处境、群体俯瞰
仰拍镜头
威严、强大、英雄感、压迫、敬畏
英雄登场、反派威慑、建筑展示、胜利时刻
荷兰角
失衡、混乱、精神错乱、危险临近
心理崩溃、真相揭露、反派登场、眩晕打斗
平视镜头
平等、对话、客观、共情、真实
访谈、对话戏、人物介绍、真诚表达
过肩镜头
对峙、对话、视角代入、关系张力
谈判、审讯、约会、争吵、双人对话
主观镜头
代入、临场、紧迫、私密
追逐、Vlog、第一人称叙事、沉浸式体验

这张表可以用来选方向,最终效果还要结合剧情语境。

比如仰拍既可以拍英雄,也可以拍反派。镜头提供力量感,人物身份、表情、光线和声音决定这股力量让人敬佩还是恐惧。

最后总结一下

写 AI 视频镜头语言,真正要交代清楚的是:

  • 观众站在谁的视角;
  • 摄影机比人物高还是低;
  • 使用什么焦段或特殊镜头;
  • 人物在画面里有多大;
  • 主体与背景是拉伸、压缩还是虚化;
  • 镜头向什么方向、以什么速度移动;
  • 这一镜要让观众感受到什么;
  • 尾帧停在什么人物关系和构图上。

最后记住这条公式:

叙事视点 + 机位角度 + 焦段或镜头类型 + 景别 + 相机距离 + 构图 + 景深 + 运镜 + 情绪目的 + 画质描述

先确定情绪,再选择镜头;把每个抽象感觉翻译成可观察的机位、距离、构图和运动,AI 才更容易生成真正有叙事作用的镜头。