ARTICLE · 1154231
AI 写的那段提示词,删掉五分之四反而更准

现在很少有人还自己一个字一个字敲提示词了。多半是把需求丢给 AI,让它写。
它交回来的东西一般长这样:
主体:一位年轻女性角色,古装造型,站在庭院里
构图:人物居中,半身构图,手部自然
光线:柔和光线,光线柔和细腻,自然柔光营造柔美的照明效果,光线温柔
风格:高级感,电影感,质感拉满,古风唯美
氛围:朦胧氛围,梦幻雾气,画面有雾感空气
质量:4K,超清,细节丰富,质感细腻
负面:不要杂乱背景,不要多余道具,不要其他人物
七个栏目,每个都填得满满当当,看上去比你写得好多了。复制去生图,出来的东西差口气。你说不清差在哪,于是往回加词。加了还不对,加负面词。等到实在不行了想推倒重来,又舍不得前面已经写进去的那些。
问题不在词不够。是同一句话,它替你说了一遍又一遍。
上面这七行,剪完能剩下五行。下面把它剪一遍。
那些重复,AI 自己看不见
先看它是怎么写出这七行的。
它是按栏目铺开的。光线一栏,它得填;氛围一栏,它也得填;质感一栏,还得分到一点东西。于是「柔和」在光线栏出现一次,在氛围栏换个说法又出现一次,到了质感栏换成「柔美」再来一次。
这不是它偷懒。它是照着「一份合格的提示词应该包含哪些栏目」这个模板在填,填满即算写完。栏目本身没有错,错在它不知道这几栏写的其实是同一件事。
有一个自查动作很有效:把那些小标题全部拿掉,把七行连成一段,从头读一遍。
柔和光线,光线柔和细腻,自然柔光营造柔美的照明效果,光线温柔,高级感,电影感,质感拉满,古风唯美,朦胧氛围,梦幻雾气,画面有雾感空气,4K,超清,细节丰富,质感细腻,肤色自然……
小标题一拿掉,重复立刻就露出来了。你会读到「柔和」出现三次,「自然」出现两次,「氛围」和「柔美」各出现一次,而「朦胧」和「清晰」这两个方向相反的词,还在这段话的两头。
单看每一栏都合理,连起来读就是在绕圈。
栏是给人看的,不是给模型看的。模型收到的就是连成一片的这一整段。你在哪一栏写的、用什么小标题分的,它读的时候都不在。
重复藏得比你想的深
删重复难在重复会换衣服。它极少是同一个词抄两遍,更多时候是下面这三种。
第一种,换词不换意思。下面这两串,每串里的词字面意思都有差别,落到画面上却是同一件事:
柔和、细腻、温柔、柔美 → 都指光不要硬
放松、随性、不刻意、自然舒展 → 都指人不要僵
你把四个词全留下,模型收到的不是「这件事很重要」,是「有四条要求都提到了这件事」,接下来它必须从中挑一个执行。
第二种,藏在不同栏目里。上面那条提示词里,光被说了三次:
光线栏:柔和光线,光线柔和细腻,自然柔光营造柔美的照明效果,光线温柔
氛围栏:朦胧氛围
质量栏:质感细腻
因为中间隔着两个小标题,你读的时候不觉得它们挨着,删的时候也就容易漏掉后两个。所以查重不能按栏目一段一段查,得按画面里的东西一个一个查。
第三种,也是最要命的一种,两句话互相打架。上面那条里就有一对:
氛围栏:朦胧氛围,梦幻雾气,画面有雾感空气
质量栏:4K,超清,细节丰富,质感细腻
一边要整体起雾,一边要细节丰富。雾漫上来的地方,细节就不可能丰富。这两句单看都是明确要求,都在同一条提示词里,都没错,可它们不可能同时成立。
你其实想要的是背景朦胧、人脸清楚。但你写的是「朦胧」和「清晰」两个没有落点的词,模型只能替你选一个。选背景还是选脸,它不知道,它随手挑。
同类的话还有一对更常见的,也是从别的提示词里抄来的:
光线:柔和漫射的自然光
质感:锐利的阴影边缘,强烈的明暗对比
两句都在说脸上的光,方向正好相反。写的时候你大概想的是「整体柔和,但要有立体感」,落成文字就成了两句互相拆台的话。
所以查重的时候,顺着画面里的东西一层一层过:光说了几次,脸说了几次,手说了几次,背景说了几次。同一个对象被交代了几遍、说的还是不是一回事,这才是要看的。只盯着词表对比一遍,漏掉的恰恰是这些。

四刀,把上面那条剪回一条
病说完了。下面是四刀,都是往下砍的动作,不是往上加的动作。
第一刀,删流程
问自己一句话:这句话镜头拍得到吗。
镜头拍不到的一律删。看这条提示词,头部有这么两句(很多人会习惯性写上):
主体:一位年轻女性角色,古装造型,站在庭院里,风格和上一版保持一致
「和上一版保持一致」,模型不知道上一版是什么,这句是空的。删掉。
再看这一句:
构图:人物居中,半身构图,手部自然,本条给封面用,左侧留标题位
「本条给封面用,左侧留标题位」是写给你自己看的备注。留白这件事要用画面语言写出来,也就是把「人物居中」改成「人物偏右」。备注本身不该留在提示词里。
改前:人物居中,半身构图,手部自然,本条给封面用,左侧留标题位
改后:人物偏右,半身构图


第二刀,合重复
问自己一句话:同一个画面事实,是不是只说了一次。
这一刀最难,因为要查的是意思不是字。做法是拿一张纸,把画面里的东西列出来,光、脸、手、背景、服装,然后逐个对象问一句:关于它,我交代了几件事。
先看光。原提示词在三个地方说它:
改前:柔和光线,光线柔和细腻,自然柔光营造柔美的照明效果,光线温柔
改后:柔和光线从画面左上方照在人物脸上


四句变一句。改后多了两样原句里没有的东西:光从哪来(左上方),照在谁身上(人物脸上)。前面四句反复强调它「柔」,却一次都没说光是从哪个方向来的。
再看手上的那句「手部自然」,删掉。它不是要求,是希望。真想让手在画面里,就得写手放在哪儿。
这一刀也有不能合并的情况。假设你写了这两句:
左手握住杯柄,右手按在桌沿
合并成「手部自然」之后读着是顺了,两只手到底在哪儿反而没了。这两句说的是两只手各自落点,都留着才有用。
第三刀,换实景
问自己一句话:「不要 X」和「××感」,写清楚了没有。
先看原提示词里那三个「不要」:
改前:不要杂乱背景,不要多余道具,不要其他人物
问题在于,什么叫杂乱。空荡的白墙不算杂乱,码得整整齐齐的书架也不算,远处有个人但没抢主体,你可能也觉得不算。你心里其实已经有一个具体的院子了,那就把它写出来:
改后:背景是一面素色院墙,墙前只有一个石灯,画面里没有其他人
这样下次图不对,你能指出是哪一处不对。只写「不要杂乱」,图不对的时候你连从哪改都不知道。
再看那一串大词:
改前:高级感,电影感,质感拉满,古风唯美
这四个词夸了一句,什么信息都没给。追问自己:我嘴上说高级,具体的依据是什么。答案多半是这三件事,那就把这三件事写出来:
改后:人物比背景亮,背景压暗;月白色衣服配深色廊柱;镜头退得够远,带进半截院墙
第三刀还有一个容易被忽略的地方,就是给上面那对打架的句子做判决。你想要背景起雾、人物清楚,那就把这件事明确写下来:
改前:朦胧氛围,梦幻雾气,画面有雾感空气
改后:远景有薄雾,人物面部清晰,发丝边缘可见
关键词从「朦胧氛围」换成了「远景」。前者的范围是整个画面,人和背景一起糊;后者把雾限制在远处,人要清楚。
第四刀,测删除
问自己一句话:删掉这句,会少一个我要的选择。
这条里最该试的是质量栏:
质量:4K,超清,细节丰富,质感细腻
删之前要想清楚它管什么。这类质量词在很多模型上确实不生效,出图分辨率由你的请求参数决定,不靠提示词写「4K」。而且「细节丰富」和你要的「远景薄雾」是有张力的,一个要处处清楚,一个要远处糊。
可以先只删这一组,别的都不动,出一张比一比。少了就放回去,说不准就留着。
这一刀要一次只砍一句。同时删掉三句,图变好了你也不知道是哪句起的作用;图变差了,你也不知道该把哪句找回来。
四刀走完,把这七行和剪完的放在一起看:
改前 改后
主体:一位年轻女性角色,古装造型, 主体:一位年轻女性角色,古装造型,
站在庭院里,风格和上一版一致 月白色织金长袍,半身立绘
构图:人物居中,半身构图,手部自然,构图:人物偏右,半身构图,人物比背景亮
本条给封面用,左侧留标题位
光线:柔和光线,光线柔和细腻,自然 光线:柔和光线从画面左上方照在人物
柔光营造柔美的照明效果, 脸上,背景比脸暗
光线温柔
风格:高级感,电影感,质感拉满, 环境:站在庭院里,背景是一面素色院
古风唯美 墙,墙前一个石灯,画面里没有其他人
氛围:朦胧氛围,梦幻雾气,画面有 虚实:远景有薄雾,人物面部清晰,
雾感空气 发丝边缘可见
质量:4K,超清,细节丰富,质感细腻
负面:不要杂乱背景,不要多余道具,
不要其他人物
七行变五行,字数少了大概五分之四。
剪掉的是:「上一版保持一致」和「本条给封面用」两句流程话;光的三句重复;「手部自然」这个空词;四个大词;三个「不要」;一组和「远景薄雾」打架的质量词。
换回来的是:光的方向和落点;一个具体的位置(人物偏右);一处具体的背景;一个具体的虚实范围。
每一次删,都要说得出这一刀为什么。
删「上一版保持一致」,因为模型看不到上一版,这句话等于没说。 删「光线柔和细腻、光线温柔」,因为它们和第一句说的是同一件事,没有多出任何一条关于光怎么打的信息。 删「手部自然」,因为它不是要求,是希望。真想让手在画面里,就得写手放在哪儿。 删「高级感」,因为它把判断留给了模型,换成「人物比背景亮」之后,这句话是可以检查的。 删「朦胧氛围」,因为它为整个画面定了调,人和背景一起糊,而你要的是远景糊、人清楚。 留「人物偏右」,因为如果这条要当封面,标题位在左边,位置是标题决定的,不是感觉决定的。
这张卡可以放在手边,改之前过一遍:
底下还有一句,它是这四刀能不能用对的前提:删的理由不能是「太长」。先保住你舍不得的画面选择,再整理句子。

为什么删掉反而更准
这是四刀里最反直觉的一步,值得单独说清楚。
删完之后,常常出现一个让人心里没底的结果:图看起来差不多。你把光那四句删成一句,出图跟原来那张比,并没有突然变得更清透。
很多人就在这一步放弃了,觉得既然删了也没用,那留着算了。
但删掉的收益不在这一张图上,在下一张图上。
还拿光那句说。现在你想把光改硬一点,只需要改一处:「柔和光线从画面左上方照在人物脸上」,把「柔和」改成「硬」,就完了。
不删的话,你得翻遍整条提示词,确认没漏掉哪个「柔美」哪个「温柔」哪个「柔和细腻」。漏一个,改完之后模型收到的是「硬光」加三句「柔和」,它还得替你选一次。
改一处和找三处,就是这么点差别。它不体现在这一张图上,体现在你改第三版、第五版的时候。
再看第三刀里那对打架的句子,删完之后的收益更明显。原来你一边写着自然柔光,一边又要求锐利的阴影边缘,现在只留下一句关于光的落点。以后无论往哪个方向调,你都知道该动哪一句,不会出现「改了上面一句,下面一句还在往回拉」的情况。
还有一层更根本的原因,是这类模型读提示词的方式。
它收到的是一份任务简报,从头读到尾,理解的是整段。同一条要求写五遍,它不会把这五条加权叠加,它读到的是五条并列的条款。其中如果有两条方向还相反,它就必须挑一个执行。
写一次,它只有一个选择。这就是删的全部意义:你删掉的不是字,是你交给它的那些决定。
否定句也是同一个道理,而且更明显。社区里实测的结论是,单纯的「不要杂乱」基本无效,因为模型不知道「杂乱」指什么;而「背景保持纯色,不要出现任何其他物体」有效,因为它把位置和对象都给了出来。
所以否定句的用法,是配着肯定句一起出现。你要说的不是一个禁区的名字,是那个位置上应该长什么样。
一句话总结这一节:提示词的长度不是问题,一个要求被交代了几次才是问题。一条写五遍的要求,和五条不同的要求,字数可以一样多,对模型是两件完全不同的事。
换一条,再走一遍
上面那条是立绘。换一条别的,看四刀是不是照样能用。
假设你要做一张电商的产品图,AI 写的初版是这样:
主体:一瓶精华液,玻璃瓶身,放在台面上
构图:居中,产品占画面三分之一,留白舒适
光线:柔和高光,光线通透,自然光感,光线干净明亮
风格:高级感,极简风,质感拉满,ins 风
背景:不要杂乱背景,不要多余道具,不要其他颜色
氛围:清新氛围,通透空气感,画面有呼吸感
负面:不要文字,不要水印,不要多余物体
第一刀,删流程。这条里没有流程句,直接进第二刀。
第二刀,合重复。关于光,这里又是四句:
改前:柔和高光,光线通透,自然光感,光线干净明亮
改后:柔和高光在瓶身左侧形成一条竖向反射


四句变一句,和上一例一样,改后多了方向(左侧)和落点(瓶身上那条反射)。原来那四句都在形容光「好看」,没一句说它从哪儿来、打在哪儿。
再看「清新氛围,通透空气感,画面有呼吸感」这三句,也是同一件事说了三遍。删掉。注意它们和上一例里的「朦胧」不同,这里删掉不留空,因为光线那一条已经把画面调子定了。
第三刀,换实景。这条里最典型的是背景那三个「不要」:
改前:不要杂乱背景,不要多余道具,不要其他颜色
改后:背景是一块浅灰色渐变板,台面上只有产品和一个玻璃托盘
「不要其他颜色」这句可以保留,但要指出范围。你没说清是产品的颜色不能变,还是背景不能有别的颜色。电商图里产品的包装色往往是硬约束,得写明:
保留:产品的瓶型和标签颜色不变,背景不要出现除灰白以外的颜色
第四刀,测删除。「ins 风」「极简风」这两个词,试着删掉。
删之前想清楚它管什么。你要的极简,其实是上面已经写出来的那几件事:产品占三分之一、背景是浅灰渐变、台面只有两件东西。这些写出来之后,「ins 风」这个词就不管事了,删掉。
再看「高级感,质感拉满」,和第二刀里的光重复,一并处理掉。
这一条剪完:
主体:一瓶精华液,玻璃瓶身
构图:居中,产品占画面三分之一
光线:柔和高光在瓶身左侧形成一条竖向反射
背景:一块浅灰色渐变板,台面上只有产品和一个玻璃托盘
约束:保留瓶型和标签颜色不变,背景不出现灰白以外的颜色
从七行变五行。你注意到没有,两条不同的提示词,走的是同一套动作,剪掉的也是同一类东西:重复的形容词、没有落点的方向、还有那些「不要」堆成的清单。
两个边界
第一个边界:别为了短而删。
删到一半,最容易开始的不是改,是跟自己较劲。已经拿掉这么多,会觉得再删一点更漂亮,于是把「人物偏右」「光从左上方来」也划掉。
这两句各自决定一件事:人的位置、光的方向。删掉任何一句,就少一项明确安排,下一张图又得靠猜。
其实「光从左上方来」这一句我试过删。删完出的图里,光并没有变得没有方向,但有几张光源飘到了右边,影子跟着翻了个面。要的是光从左上打过来、人物比背景亮,所以这句又加了回来。删不动的那句,往往就是它在管着一件事。
第二个边界:一次只改一件事。
还拿第三刀里那句「朦胧氛围」说。它和「细节丰富」打架,你一次把它们两个都删掉,图变清楚了,可你分不清是删「朦胧」起的作用,还是删「细节丰富」起的作用。下次只想解决其中一处,你又不知道留哪个。
一次只砍一句,图的哪一处变了,你能对上号。
四刀是按顺序切的,不是一把全下。切一刀,看一眼,再切下一刀。
落点
回头看,AI 写的那段之所以看着专业,是因为它把每一栏都填满了。
就拿开头那条来说,七个栏目,主体、构图、光线、风格、氛围、质量、负面,一个不缺,排得整整齐齐。可剪完之后你才发现,这七行里,真正决定画面的是五六句话,剩下的都是同一句换个说法再讲一遍。
栏目齐全是形式上的专业,不是能被执行的清楚。它像一份没有重点的会议纪要,每条都写了,但你不知道该先做哪件。
一条提示词好不好,判据只有一个:你读它能读懂,出了问题知道改哪一句。删到你能读懂,就停下。
读到一句话,就问它给画面增加了什么。如果它只是在换着法子夸「高级」「精致」,删掉;如果是在说人往哪儿站、光从哪儿打过来,留下。
别因为它看起来够专业,就舍不得碰它。

往期精选 远见明察
一个爱研究 AI 的小角落 · 把复杂技术变成简单好玩的使用方法
|
| ||
|
|
★ 设为星标,更新抢先看 · 不迷路



