ARTICLE · 1083351
AI 出的视频像监控?因为你只告诉它拍谁,没告诉它怎么拍
AI 出的视频像监控?因为你只告诉它拍谁,没告诉它怎么拍
你手上有一句能用的出图提示词。复制,粘进视频框,点生成。
人是对的,光是对的,构图也没跑。但看着就是不对,像小区门口调出来的录像。
不是模型不行。是你没交代摄像机怎么动。
01 · 监控感是怎么来的
出图和视频不是同一道题,虽然它们长得像。
你只答了头一行,模型就没有镜头指令可听。
拿不到指令的时候,它会挑一套保险的默认值。机位不动,画面全都清晰,主体微微动一点点。这套默认值的外号就叫监控感。
所以不是它笨。是它太听话,它不敢替你决定镜头往哪走。
这里有个坑得单独说。「电影感」这三个字不是镜头指令,它管的是画面的味道,管不了摄像机动不动。你在末尾堆「电影感、大片感、高级感」,模型不会因为这三个字就给你推一个镜头。
你可能会想,那我写「电影级运镜」总行了吧。
也不行。那还是个形容词。从哪转到哪,转多久,你一个字都没说。

02 · 四个槽位,一句一个
视频提示词比出图多的,就是这四个槽位。每个槽位一句话,填进去就行。
术语不用背,翻译成人话就这几个。
四个槽位里,运镜的性价比明显更高。别的写错还能看,不写运镜,整段立刻掉回记录素材。
写的时候对着这张表念一遍,漏哪个补哪个。念完这段,你要写的东西就清楚了。
03 · 把你那句出图提示词升级成视频句
不用重写。你原来那句留着当主体,后面接两段就行。
前置串,就是你出图那句,复制这段
一个穿米色针织衫的年轻女生,站在傍晚的海边沙滩上,长发被海风吹向一侧,暖金色夕阳从画面右侧打过来,写实摄影质感,横版构图
追加串,四个槽位,复制这段
中景,半身入镜;镜头从她的侧后方缓慢环绕到正面,转半圈;她本人原地不动,只有头发、衣角和远处的海浪在动;前两秒镜头不动,第三秒开始环绕,总时长 5 秒
兜底串,收尾,复制这段
镜头运动匀速,画面稳定不抖动,人物面部和手部结构正常不变形,全程同一个场景不切换,画面里不要出现文字和水印
三段拼起来,直接丢进豆包或即梦的视频框就能出。看着长,只有中间那段是你新写的。
两个可以改的变量
运镜方式。环绕换成侧移、推近、跟随都行,一次只换一种。 主体和场景。海边女生换成咖啡馆窗边、城市街道、书桌前,前后两句的结构不动。

04 · 同一句,加与不加差在哪
❌ 一个女孩站在夕阳下的海边,长发被风吹起,温暖的金色光线,写实摄影,电影感
主体有,场景有,光线有,风格也有。唯独没有镜头。模型只能给你一个不动的机位,风在吹,画面不动,看十秒就腻。
✅ 上面那三段式
多答了四个问题。摄像机从哪转到哪,离人多远,谁在动谁不动,五秒里怎么分配。
差别不在字数,在你有没有把镜头这件事说出来。
05 · 三个场景,只改中间那句
第三个留意一下。它用的是静止镜头,照样成立。
要点不是非得让镜头动,是你得自己指定。写「静止」也是一种指定,模型知道你要钉死。什么都不写,它就替你选一个没性格的默认值。
06 · 出完先别急着发,按这几条验
省事的验法不用看好不好看。看背景里的直线。
墙缝、地平线、栏杆、窗框,这些线在画面里从头到尾纹丝不动,说明全片没有运镜。有运镜的片子,直线会缓慢改变角度或者变长变短。
一秒就能判。
你可能会说,我那段明明有推镜头,怎么还是没质感。
大概率是推得太急。三秒推完和五秒推完,出来是两个东西。把时长往后放两秒,再出一次看。
翻车表
出完扫这五问
背景里的直线动了没有 五秒里主体在画面里的大小变了没有,有运镜就该变 想动的东西动了,不想动的真的没动 从头到尾是同一个地方,没换场景 缩到手机上看,还看得出镜头在走吗

画面好不好看,是模型的事。镜头走不走,是你的事。
现在就能做的一件事。把你手头那条不满意的视频翻出来,找到当初那句提示词,只补一句运镜,别的都不动,重新出一次。背景里的直线一动,片子就活了。
我是南烬川,专门把 AI 玩法拆成照着做一遍就能出东西的步骤。觉得有用,收藏一下,下次写视频提示词直接翻出来抄。