ARTICLE · 1078114
AI 出的图单张都挺好,摆成一组就散了
AI 出的图单张都挺好,摆成一组就散了
攒了一组图,单张点开都挺像样。往朋友圈九宫格里一摆,怎么看怎么像十个人做的。
挑出不对的那几张重出,出了三遍,还是散。
不是画得不好。是每张都在重新发明一遍。
模型每跑一次都算一件全新的事。你这次写「高级感」,下次写「有质感」,它不知道这两张是一套,只能每次重新猜。
一组图要成套,靠的不是每张都画得好,是每张都重复同一批元件。
下面给你五个零件、两条能直接复制的串、三条硬限制,和一组自检。换一个词就能连出七张。
01 · 先搞清楚散在哪
一组图摆一起觉得散,通常是这五样东西里,有一样每张都在变。
| 一个字都别改 | ||
大部分人写提示词,眼睛全盯着主体。主体换七次,背景跟着换七次,出来的自然是七个世界。
你可能会说,背景次次一样会不会太单调。
恰恰相反。成套的感觉,就是从「背景从来没变过」这儿长出来的。

02 · 两条串,一套图的骨架
先给两条串。这组图从头到尾不动它俩,你每次只改夹在中间的那句。
前置串,复制这段
竖版构图,平面矢量插画风格,极简,高对比,画面干净
后置串,复制这段
背景是均匀的深灰色,人物左侧有一盏黑色复古路灯,灯光是暖黄色;脚下有一滩金色液体,映出鞋子的倒影;整张图只用深灰、纯黑、亮金、亮红四种颜色;线条干净,无纹理,无渐变,无文字,无水印,有光泽感,神秘、高级
后面那条看着长,拆开就三件事。环境一句,限色一句,收尾一句。
验一下这两条管不管用
连出三张,只改夹在中间的角色。再把后置串整段删掉,重新出这三张。两堆往一起一放,差别不用我说了。
03 · 中间那句怎么填
两条串定死,剩下就一句要你写。给一份完整的。
可变主体,复制这段
一个戴礼帽穿长风衣的人,从画面左侧往右走,全身是纯黑剪影,看不出五官;他的长风衣是画面唯一的高光部分,质感像正在融化的金色金属,下摆有厚重的滴落,空中有飞溅的金色液滴;脖子上系一条亮红色领带,脚上一双亮红色皮鞋
三段拼起来,直接丢进豆包就能出。
正反例放一起看
❌ 一个穿金色衣服的黑色人影,站在街上,好看,高级,有设计感
没有构图,没有唯一焦点,没有环境,也没有限色。模型只能瞎猜,出十张就是十个结果。
✅ 上面那三段式
主体、唯一焦点、点缀色、固定环境、限色板,五样齐全。换角色只改中间一句,前后两句不动。
两个可以改的变量
职业和焦点衣物。侦探配长风衣,国王配王袍,舞者配纱裙,厨师配围裙,每次只让一件化金。 点缀物。亮红领带换成武士刀、面具、王冠、高跟鞋都行。一处就够,别多。

04 · 换人就散,通常栽在这三条上
零件都齐了,一组图照样能出岔子。换角色的时候,下面三条经常破功。
限制一,焦点只能有一个
两件衣物同时化金,画面里就有了两个抢眼的地方,眼睛不知道往哪儿落,金色也跟着发腻。
看哪儿。把图缩到一半大小,问自己第一眼停在哪儿。答不出来,就是焦点多了。
限制二,画面里加人,得补一句约束
两个剪影挨在一起,模型很爱把他们融成一坨。单人那套串拦不住这个,得显式加一句。
两个剪影轮廓清晰分开,不粘连,不融合,不共享肢体
验的地方在两个黑块交界处,看边缘是不是一直分得开。交界糊成一片,就是这句没生效。
限制三,别写具体的名人或角色名
这条听着反常识。你写某个动漫角色、某个明星的名字,他的标志性特征会自己长回来。草帽、红发、麻花辫,全都在。
这类名字在训练素材里出现得太密,一写进去,它的权重直接压过你前面那句「纯黑剪影,看不出五官」。
一看出戏的颜色或道具,八成是某个名字在作怪。
要么接受特征回来,要么别用这些名字。想要干净的剪影,就用没有固定长相的职业词。侦探、骑士、厨师、宇航员这类词,说一不二。
模型不会替你记着这是一套。记住的只能是你。

05 · 三个场景,只改一句
三个场景的共同点是改动永远只有一处。你动的地方越多,成套的概率越低。
06 · 出完一组,按这五问过一遍
十张摆一起,颜色是不是同一组? 每张的高光是不是只有一个? 环境那句是不是一字没改? 有没有哪张长出了脸? 缩到手机上指甲盖大小,扫一眼还认得出是同一套吗?
第五问狠,也准。成套的图缩小了还是一套,不成套的图放大了也不成套。
单张好看不难。难的是十张摆一起,还像一个人做的。
差别就在你有没有给模型留一点重复的东西。
现在就能做的一件事。把你手上那组图翻出来,用第五问扫一遍。过不了的那几张,别重画,把环境那句和限色那句补回去再出一次。
我是南烬川,专门把 AI 玩法拆成照着做一遍就能出东西的步骤。觉得有用,收藏一下,下次配图直接翻出来抄。