ARTICLE · 1094374
Day 36 ——AI绘画用什么工具好?先看懂AI"画画"的原理,再对号入座
AI绘画用什么工具好?先看懂AI"画画"的原理,再对号入座
昨天我们做了AI 绘画实战,一句话出图,三步改成能发朋友圈。
朋友小王照着画了张全家福,然后发来一句追问:"AI 是不是肚子里存了几百万张画?我让它画猫,它就去找一张最像猫的,东拼一块西凑一块?"
这个问题问得特别好,而且错得很有代表性。今天把这件事讲透,再顺手给你一张平台选型表——工具那么多,别再靠一个个试。
🎨 它不是拼贴匠,是个"擦噪点"的雕塑家
如果 AI 真靠拼贴,那它画"戴墨镜的柯基在冲浪"就只能找来一张柯基、一张海浪硬缝——你会看到明显的接缝。可现实是,它能画出一张从来不存在于任何地方的画面。
米开朗基罗说过一句很有名的话:雕像本来就在大理石里,他只是把不属于它的部分去掉。AI 画画的过程,跟这个很像。
从一整屏雪花开始
它不是从白纸画起,而是从一张纯随机噪声图开始——就像老电视没信号时那种满屏雪花。什么都没有,但什么都可能是。
你的提示词,是"导航"不是"图纸"
"戴墨镜的柯基在冲浪"这句话不会直接变成画面,而是被翻译成一个方向:擦噪点时,往有柯基、有墨镜、有浪花的那个方向擦。这背后是"文图对齐"模型的功劳——2021 年 OpenAI 的 CLIP 第一次把"文字"和"画面"放进了同一个坐标系里比对,让 AI 知道"狗"这个字对应画面里的什么。
几十步"擦"出成品
每一步只擦掉一点点噪声:先是模糊的色块,然后是轮廓,然后是毛发和浪花。几十步之后,一张完整的画从雪花里浮了出来。
这类模型叫扩散模型。训练时它学的是"怎么把干净图搞脏",用的时候反过来——把脏图还原干净。听着绕,本质就是练一个本事:从噪声里认出图。
而这套本事装在哪儿?还是我们Day 4 讲过的神经网络——一堆参数调来调去,最终学会"这里该有眼睛、那里该有浪花"。
🧠 从"拼贴"到"去噪",这十二年发生了什么
2014 年 · GAN 登场
两个模型互相当"造假者"和"鉴宝师",第一次让 AI 能生成像样的图。缺点是极难训练,稍不留神就崩。
2020 年 · 扩散模型跑通
DDPM 那篇论文把"加噪—去噪"这套框架做成了可复现的工程方案,生成质量第一次系统性地超过 GAN。
2022 年 · 走进所有人手里
Stable Diffusion 开源、Midjourney 开放公测。文生图从实验室走进普通人的浏览器,"人人都是画家"从口号变成了现实。
2023—2026 · 中文与"好改"成主战场
画得像已经不够了,现在比的是:懂不懂中文、能不能改局部、出图快不快、图层能不能单独拖。今年 9 月刚上线的 Seedream 5.0 flash 就是这条路——一句话之外,还能把一张图拆成底图和多个可独立编辑的图层。
🗺️ 平台那么多,按你的身份选
昨天讲"怎么出图",今天讲"用哪个"。还是那个心法——先定活儿,再选人(这条我们在Day 34 选模型时也用过)。把"哪个工具最好"翻译成"我是谁":
刚想试试、一分钱不想花 → 豆包
免费出图,抠图能力强,能替掉一部分"打开 PS 抠个图"的活儿。理解力比专业选手弱一点,画风偶尔抽象,但零门槛。
做中文海报、公众号配图、电商图 → 即梦
字节 Seedream 系列,中文提示词直接写、不用翻译,中文排版和海报是它的强项。新版本还能按框选、箭头指定区域做精准编辑,改标题、换背景不用整张重画。
要写实人像、带文字的商业图 → 可灵图片 3.0
人物自然、动态感强,带精准文字排版的电商图是它的拿手戏;还能出风格统一的"系列组图",做一套物料不用一张张凑。
愿意反复调试、对画面有想法 → 通义万相
阿里 Wan 系列,有免费额度,出图稳定上限高。但它极度依赖提示词——词写不好就容易"抽卡",适合愿意调的人。
追求艺术感天花板、愿意付费 → Midjourney
审美依然是公认的标杆,画面层次和质感最耐看。代价是要英文提示词、月费不便宜,中文理解一直是它的短板。
想本地部署、重度折腾 → Stable Diffusion / FLUX
开源、自由度最高,可以装别人的风格模型、自己搭工作流。代价是要有一张像样的显卡,以及一颗愿意折腾的心。
📊 一张表带走
⚠️ 两个提醒,别踩坑
AI 生成图的版权规则各家不同、也还在演进。发朋友圈没问题,真要印在包装上、用在广告里,先看清楚该平台的商用条款。
→ 关键词:玩随便玩,商用看条款。AI 画图不会像文字那样"编造事实",但会犯低级错:手指数量不对、招牌上的字写错、英文单词拼错。发布前自己放大看一眼。
→ 关键词:手和字,出图必查。别指望一次命中。让工具一次给四张,挑最接近的那一张,用局部重绘改细节——比反复换工具有效得多。
→ 关键词:改提示词,比换工具更值。🎯 今天的动手作业
拿同一句提示词——比如"一只戴墨镜的柯基在夕阳下的海边冲浪,暖色调,胶片质感"——在两个不同平台各出四张。
对比一下:哪家更懂你的中文?哪家更懂你的审美?这份对比,就是属于你的选型报告,比任何排行榜都准。
📝 今天带走三句话
- AI 不是拼贴,是去噪:从一屏雪花开始,提示词当导航,几十步擦出一张画——这就是扩散模型。
- 十二年三步走:GAN 会造图(2014)→ 扩散模型造得好(2020)→ SD/Midjourney 让人人可用(2022)→ 2023 至今,中文理解和"好改"才是主战场。
- 按身份选工具:免费豆包、中文即梦、人像可灵、调词万相、审美 Midjourney、折腾 SD/FLUX。
🎯 自测三题
有人说"AI 画画就是从网上找图拼起来的",你会怎么三句话纠正他? 你要给公司做一张带活动标题的中秋海报,选哪个工具?出图之后还要检查哪两样东西? 同一句提示词,在 A 平台出图很丑、B 平台却很漂亮,最可能的原因是什么?
📣 Week 6 第二站:原理讲透了
1️⃣ 点个「在看」,标记你的 Day 36
2️⃣ 转发给那个"以为 AI 在拼图"的朋友
3️⃣星标「跟着狐狸学AI」,明天 Day 37 · AI 绘画进阶:Prompt 怎么写才出好图