ARTICLE · 1118580
AI短剧提示词怎么写?我的文生图模板全公开
先说结论
我做《僵尸也疯狂》,最常被问的不是“用哪个模型”,是“你的提示词怎么写的”。

先说结论:画面飘,十有八九不是模型的问题,是提示词写得像散文。
我最开始就是这么干的。给 AI 写一段“昏暗的便利店,一个孤独的僵尸,气氛很压抑”——听起来挺有感觉,出来的图十张里九张不能用。人物表情不对、光线乱飘、背景凭空长出一堆东西。
后来我改了写法:不写感受,写镜头。
我把提示词拆成四段
一条能用的画面提示词,我只填四个位置:
第一段,主体。谁,在干什么,身上什么状态。写具体,别写抽象。“一个穿蓝色便利店工服的年轻男人,站在收银台后面,低着头”——具体到“蓝色工服”“收银台后面”,AI 才有东西可抓。
第二段,镜头。景别、机位、焦段。这是最多人漏掉的一段,也是最能出效果的一段。“中景,平视,35mm,人物占画面左侧三分之一”。竖屏短剧尤其要写构图留白,不然人物死死卡在中间,后面图生视频一动就出画。
第三段,光。光源从哪来、什么颜色、多硬。便利店的戏我基本固定写“顶部冷白荧光灯为主光,玻璃门外透进青色夜光,人物面部一半在阴影里”。恐怖感不是靠黑暗堆出来的,是靠一块亮和一块暗的对比切出来的。
第四段,风格与画质。这一段的写法要克制。我早年在末尾堆过一堆词,画面反而糊。
恐怖但克制,关键是把形容词换成名词
这是我踩坑最多的地方,单独说。
“恐怖”是个形容词,AI 收到这个词,会给你血浆、裂脸、满地爬的东西。这恰好是我最不想要的——《僵尸也疯狂》是灵异轻喜,基调是灵异+人间烟火+克制深情。一旦画面开始猎奇,人物就没法让人共情了。

我的做法是:把情绪换成能拍出来的东西。
不写“恐怖的便利店”,写“冰柜的冷光、地上摊开的一本旧杂志、收银台上没人接的内部电话”。恐怖不写在形容词里,写在道具里、写在光里、写在“这个空间里刚刚有别人待过”的痕迹里。
观众不会因为你写了“恐怖”而害怕,会因为那部没人接的电话自己害怕。
同样的逻辑,我需要暧昧或深情的时候也不会写“暧昧”“深情”,我写“她手心里那颗融了一半的糖”。一个具体的物件,比四个形容词都准。
三个我固定在用的习惯
一是每个主要场景,我写一次就存成“场景词块”,之后所有镜头直接复用。便利店、楼道、出租屋,各有各的一套光与道具描述。同场景不同镜头,只有景别和机位在变。这样出来的画面,观众才觉得是“一个地方”。
二是人物外观描述,每个角色做一张固定卡。发色、发型、五官特征、常穿的衣服,一条不改地复制到每一条提示词里。这是图生视频之前,人物能看起来像同一个人的前提。
三是“不要”的那部分,我只写一到两条。比如“画面中不出现文字”“不要第四个人物”。否定词写得越多,模型越容易盯着它不放。与其列十条不要的,不如正面把要的写清楚。
一条完整的例子
把四段拼起来,我实际用过的一条长这样:
“一个穿深蓝色便利店工服的年轻男人,站在收银台后面低头整理货架,中景,平视,35mm,人物在画面左三分之一,右侧留白;顶部长条冷白荧光灯为主光,玻璃门外透进青色夜光,面部一半在阴影中;店内货架整齐但有生活痕迹,收银台放着一部没挂好的内部电话;写实电影质感,自然颗粒,竖屏 9:16。”
这条不需要多漂亮。它需要的是能被执行——景别清楚、光源清楚、人物在画面哪个位置清楚。AI 视频最终是要动起来的,你的提示词就得先替它想好构图。
写提示词这件事,说到底是把你脑子里的画面,翻译成“可以被拍出来”的语言。感受留给你自己,剩下的全写具体的。
《僵尸也疯狂》S3 正在做,每一集的制作过程我都会写在这里。