ARTICLE · 1100078
AI 视频越来越「像实拍」,是提示词里这三个词的功劳
先看三条视频。
第一条,抖音上疯传的「祖国人」:有人把这个超人角色塞进了一部年代剧——暮色里贴着地面飞行,落地之后是昏黄吊灯下的家常戏,字幕打出来「以后咱们就是四口之家了」。发帖的人只加了一句「现在 AI 生成视频劲太大了」,295 赞,评论区一半在问出处,一半在问「这真是 AI?」

年代戏质感的 AI 短片:暖光吊灯下的一家人
第二条,一个服装店里的人台试衣视频:灰色人台抬手拉开胸衣的系带,布料跟着手的力度形变、回弹,背景的衣架全部虚化。418 赞,是这三个样本里最高的。
第三条,Seedance 2.5 的情侣互动测试:一对情侣在客厅打闹,结尾接吻,发帖的人重点夸的是「人物的肌肤表现好真实」——48 赞不算爆,但他那条贴出了完整提示词,值得单独拆。
三条视频,三种题材,横跨竖屏和横屏、剧情和展示,却共享同一件事:它们都骗过了你的第一眼。
而你自己用 AI 生成视频的时候,大概率遇到过相反的困境:画面明明很美,就是一眼假——人物像雕塑,动作像漂移,衣服像画上去的。你在提示词里堆了「8K」「电影感」「浅景深」,还是假。
问题不在画质。拆完这三条视频,我发现实拍感的来源非常具体:不是形容词,是三个动词。
01镜头对视:承认镜头在场 EYE CONTACT
回看那个 418 赞的人台视频和爆火的「祖国人」,它们都有一个共同点:镜头不是隐形的。
传统 AI 视频的默认镜头,是一个飘在半空的旁观者——人物各演各的,镜头想看哪看哪。而真实生活里,镜头几乎从不隐形:自拍有举着的手,采访有对视的紧张,监控有它独特的俯角。人对「被拍摄感」的敏感是刻在基因里的。
所以那条人台视频的原提示词里,最关键的就是最土的四个字:
「镜头对视」四个字,把镜头从旁观者变成了交流对象。人物看向镜头,你的大脑会立刻判定:这是一个真实空间里的真实互动——因为只有真实的人,才会看向正在拍他的人。
进阶写法是给「对视」加时间和情绪:「她看向镜头两秒,笑了一下,移开」「目光扫过镜头,又躲开」——躲,也是动词,而且是只有真人才会做的动作。
02呼吸起伏:给身体装上「内部运动」 BREATHING
AI 人物一眼假的第二大死穴:太静了。
静帧的时候它很好看,一动起来你就觉得不对——因为 AI 生成的人物经常只有「任务动作」(走路、转身、说话),没有「生理动作」。真人永远在动:呼吸让胸口起伏,说话前会下意识吸气,跑完会喘,紧张会吞咽。这些运动和剧情无关,纯粹是活着的证据。

暮色中贴地飞行的超英角色:大片感之外,晃动和大气透视给了它实拍的底色
「祖国人」那条的飞行镜头就是例子:超英题材本来就假,但镜头带着轻微的惯性晃动,暮色的雾气里有颗粒感的透视——这些「不完美」叠在一起,大脑就放弃了打假。
提示词写法,直接给身体装内部运动:
●「胸口随呼吸轻微起伏」
●「剧烈奔跑后扶着墙喘息」
●「说话前深吸一口气,再开口」
一句话总结:呼吸是有情绪的。「沉重呼吸」比「自然呼吸」多了一层叙事——模型会连带调整肩部、节奏、表情,这一个词撬动的是整组身体语言。
03布料形变:材质要响应外力 FABRIC PHYSICS
第三条人台视频,拆到帧级别,它最「骗人」的瞬间其实是手和布料接触的那两秒:手指发力,针织面料的纹路被拉紧,松手,回弹。

人台试衣:手与布料的交互是整条视频实拍感的来源
大多数 AI 视频里,衣服是「画」在人物身上的贴图——人动,衣服跟着动,但没有自己的物理生命。而真实世界里,布料永远在响应外力:被拉扯会变形,松开会回弹,转身时裙摆会甩出弧度、落下时还在晃。
「祖国人」那条里的年代戏部分同样受益于此:小孩靠在门框上仰头笑,粗布棉袄的褶皱堆在肘弯——

红领巾、门框上的身高刻度、粗布棉袄:年代戏的实拍感藏在衣物褶皱里
提示词写法,把服装从「名词」变成「动词」:
●「针织衫被拉长又回缩」
●「裙摆随转身甩出弧度,落下时还在晃」
●「风把衬衫吹得贴在背上,又鼓起来」
04抄作业:一条完整提示词的人体解剖 FULL ANATOMY
三个动词讲完,再看它们怎么在一条真实提示词里协同。Seedance 那位博主贴出的《你过来》,几乎是一条「实拍感要素齐全」的标本:
逐行看它做对了什么:
●男友视角 + 左手持手机拍摄:镜头在场感的完全体——镜头不但存在,还有「谁在举着它」。这是比「镜头对视」更强的实拍信号,因为手持的第一人称视角自带微晃。
●保持原图的盘发、衣裙:图生视频的人物一致性约束,「针织开衫」这个材质词同时给了布料形变的表演空间。
●窗边自然光照亮她的脸:光源有出处(窗),有方向(照脸),不是「电影感打光」这种空话。
你会发现这条提示词里没有一个「高大上」的画质词,全是具体的、可执行的画面指令——实拍感从来不是调出来的,是「拍」出来的,提示词要写的是那份拍摄说明书。

三动词对照卡:可直接抄进下一条提示词
05结尾:删掉三个形容词,换上三个动词 CTA
下次写视频提示词之前,做个小实验:
把「8K 画质」「电影感」「大师摄影」这三类词全部删掉,换成这三个句式——「镜头对视,她看了两秒才移开」「胸口随呼吸轻微起伏」「针织衫被拉长又回缩」。
生成两条对比一下。大概率你会回来找我聊第四个动词:眼神里的焦点变化——那是下一期《一格美学》要拆的东西。
数据与素材说明:文中三条样本均来自 X 平台 2026-09-25 至 09-29 的公开帖子(点赞数截至 09-29),样本视频画面仅用于美学分析。