
前段时间,我开始使用一个叫“小黑”的开源配图 Skill。
它的形象很简单:黑色实心身体、两只白点眼睛、细细的腿,表情总是空空的。它不负责卖萌,而是一本正经地做一些略显荒诞的事。
最近,我又在 GitHub 上看到一个热门项目:awesome-gpt-image-2。我查看时,它大约有 2.2 万颗星,收集了大量生图案例、提示词模板,还提供一个可以安装的风格选择 Skill。
于是我把它装了下来,并让它为这篇文章配图。
第一轮结果很完整:米白纸张、精致拼贴、三栏信息图,文字也很清楚。
但我不喜欢。
更关键的是,图里的“小黑”变了:有的长出了人的身体,有的像商业吉祥物,有的只是站在旁边充当装饰。
一个工具能整理很多风格,不代表它知道哪种风格属于你。
三样东西,其实不在同一层
1. GPT Image 2:负责把图生成出来
GPT Image 2 是底层图像模型。按照 OpenAI 的官方说明,它可以根据文字或图片输入生成和编辑图像。简单说,它是“能画”的那一层。
模型越来越擅长理解要求、生成中文、保持画面一致性。但它不会自动知道你真正喜欢什么,也不知道一篇文章最值得画的是哪一句。
2. GitHub 生图 Skill:把方法整理好
这次安装的 gpt-image-2-style-library 不是新模型,而是一套公共方法库。它把海报、信息图、产品图、角色图等任务分类,再补上构图、色彩、文字、比例和避坑要求。
它解决的是“怎样更稳定地画”。它能提供很多选择,却不会自动替我决定哪一种才是我。
3. 小黑 Skill:用固定语言解释观点
小黑同样是别人开源出来的配图 Skill。它与风格库的区别,不在于一个开源、一个私有,而在于约束范围。
风格库追求“我有很多风格可以选”;小黑追求“无论画什么,都要守住这一套形象和气质”。它解决的是“怎样持续用同一种语言表达”。

为什么第一轮图失败了?
不是模型不会画,也不是新 Skill 没有价值。真正的问题是,我把公共风格库放在了最高优先级。
它选择了适合知识解释的信息图模板,却覆盖了小黑原本的纯白、极简、怪诞和冷幽默。我又只用文字描述小黑,没有用固定参考图锁定角色,模型听懂了“黑色小人”,却没有守住“小黑是谁”。
返工时,我把顺序改成:小黑固定形象不能变 → 小黑风格规则优先 → 公共 Skill 只整理提示词 → 最后才由模型执行。
用活体香草再做一次对照
为了避免只凭审美下结论,我拿自己的活体香草项目做了第二次测试。
任务一:让潜在顾客想了解产品
我请公共风格库制作一张面向城市家庭的产品海报。它选择商品商业视觉模板,把香草、厨房场景、标题和卖点组织成一张竖版海报。

这张图的工作是吸引顾客。产品必须真实、清楚、有生活感,小黑没有出现的必要。
任务二:让文章读者理解一个区别
我再让小黑解释活体香草与普通切割香草有什么不同。它不负责把罗勒拍得诱人,而是把判断画出来:切割香草从被剪下的那一刻开始倒计时;活体香草仍在生长,可以按需摘取。

两种 Skill 到底怎么选?
最简单的判断:这张图是在卖东西,还是在解释东西?
工具越多,越需要知道自己不要什么
当所有人都能调用相似的模型和模板,我们更容易产出一批“很好看,但不像自己”的图片。解决办法不是拒绝公共工具,而是给工具排好位置:
模型提供生成能力。 Skill 提供经过整理的经验。 创作者负责最后的取舍。
即使小黑本身也是开源的,我仍然需要决定用不用它、怎样使用、哪些形象不能变化,以及它是否适合这篇文章。
真正形成个人表达的,也许从来不是拥有一个别人没有的工具,而是长期坚持一套清楚的选择。
公共工具箱可以越来越大,但握住那支笔的人,还是要知道自己想画什么。
如果是你,你更想要一个拥有几百种风格的工具箱,还是一种能够长期坚持的表达方式?欢迎留言告诉我。
本文属于「AGI新知与实践」系列
这里是「非此或彼观察室」
不急着二选一,把新知变成实践。
参考资料
[1] OpenAI:GPT Image 2 模型说明
[2] GitHub:awesome-gpt-image-2
[3] GitHub:gpt-image-2-style-library
说明:文中星标数为 2026 年 8 月 27 日查看 GitHub 页面时的采集值,会随时间变化。活体香草海报为概念测试。
夜雨聆风