夜雨聆风学习资料网

ARTICLE · 1094374

Day 36 ——AI绘画用什么工具好?先看懂AI"画画"的原理,再对号入座

Day 36 ——AI绘画用什么工具好?先看懂AI"画画"的原理,再对号入座
Day 36 / 9040%
🦊
跟着狐狸学AI
专家视角 · 每天5分钟,90天成为AI科普专家
Day 36 · Week 6 · AI创作工具第二站

AI绘画用什么工具好?先看懂AI"画画"的原理,再对号入座

周六你已经一句话出过图,今天补上"为什么"——AI 不是拼贴匠,是个"擦噪点"的雕塑家;讲完原理,再给你一张平台选型表。
跟着狐狸学AI · 第36/90天 · 2026年9月28日

昨天我们做了AI 绘画实战,一句话出图,三步改成能发朋友圈。

朋友小王照着画了张全家福,然后发来一句追问:"AI 是不是肚子里存了几百万张画?我让它画猫,它就去找一张最像猫的,东拼一块西凑一块?"

这个问题问得特别好,而且错得很有代表性。今天把这件事讲透,再顺手给你一张平台选型表——工具那么多,别再靠一个个试。

🎨 它不是拼贴匠,是个"擦噪点"的雕塑家

如果 AI 真靠拼贴,那它画"戴墨镜的柯基在冲浪"就只能找来一张柯基、一张海浪硬缝——你会看到明显的接缝。可现实是,它能画出一张从来不存在于任何地方的画面。

米开朗基罗说过一句很有名的话:雕像本来就在大理石里,他只是把不属于它的部分去掉。AI 画画的过程,跟这个很像。

1

从一整屏雪花开始

它不是从白纸画起,而是从一张纯随机噪声图开始——就像老电视没信号时那种满屏雪花。什么都没有,但什么都可能是。

2

你的提示词,是"导航"不是"图纸"

"戴墨镜的柯基在冲浪"这句话不会直接变成画面,而是被翻译成一个方向:擦噪点时,往有柯基、有墨镜、有浪花的那个方向擦。这背后是"文图对齐"模型的功劳——2021 年 OpenAI 的 CLIP 第一次把"文字"和"画面"放进了同一个坐标系里比对,让 AI 知道"狗"这个字对应画面里的什么。

3

几十步"擦"出成品

每一步只擦掉一点点噪声:先是模糊的色块,然后是轮廓,然后是毛发和浪花。几十步之后,一张完整的画从雪花里浮了出来。

这类模型叫扩散模型。训练时它学的是"怎么把干净图搞脏",用的时候反过来——把脏图还原干净。听着绕,本质就是练一个本事:从噪声里认出图。

而这套本事装在哪儿?还是我们Day 4 讲过的神经网络——一堆参数调来调去,最终学会"这里该有眼睛、那里该有浪花"。

🧠 从"拼贴"到"去噪",这十二年发生了什么

1

2014 年 · GAN 登场

两个模型互相当"造假者"和"鉴宝师",第一次让 AI 能生成像样的图。缺点是极难训练,稍不留神就崩。

2

2020 年 · 扩散模型跑通

DDPM 那篇论文把"加噪—去噪"这套框架做成了可复现的工程方案,生成质量第一次系统性地超过 GAN。

3

2022 年 · 走进所有人手里

Stable Diffusion 开源、Midjourney 开放公测。文生图从实验室走进普通人的浏览器,"人人都是画家"从口号变成了现实。

4

2023—2026 · 中文与"好改"成主战场

画得像已经不够了,现在比的是:懂不懂中文、能不能改局部、出图快不快、图层能不能单独拖。今年 9 月刚上线的 Seedream 5.0 flash 就是这条路——一句话之外,还能把一张图拆成底图和多个可独立编辑的图层。

一个比方:GAN 像两个人在吵架里互相变强,扩散模型像一个人安静地擦玻璃。后者慢一点,但擦得干净——这就是为什么今天主流的文生图模型几乎都走扩散路线。

🗺️ 平台那么多,按你的身份选

昨天讲"怎么出图",今天讲"用哪个"。还是那个心法——先定活儿,再选人(这条我们在Day 34 选模型时也用过)。把"哪个工具最好"翻译成"我是谁":

1

刚想试试、一分钱不想花 → 豆包

免费出图,抠图能力强,能替掉一部分"打开 PS 抠个图"的活儿。理解力比专业选手弱一点,画风偶尔抽象,但零门槛。

2

做中文海报、公众号配图、电商图 → 即梦

字节 Seedream 系列,中文提示词直接写、不用翻译,中文排版和海报是它的强项。新版本还能按框选、箭头指定区域做精准编辑,改标题、换背景不用整张重画。

3

要写实人像、带文字的商业图 → 可灵图片 3.0

人物自然、动态感强,带精准文字排版的电商图是它的拿手戏;还能出风格统一的"系列组图",做一套物料不用一张张凑。

4

愿意反复调试、对画面有想法 → 通义万相

阿里 Wan 系列,有免费额度,出图稳定上限高。但它极度依赖提示词——词写不好就容易"抽卡",适合愿意调的人。

5

追求艺术感天花板、愿意付费 → Midjourney

审美依然是公认的标杆,画面层次和质感最耐看。代价是要英文提示词、月费不便宜,中文理解一直是它的短板。

6

想本地部署、重度折腾 → Stable Diffusion / FLUX

开源、自由度最高,可以装别人的风格模型、自己搭工作流。代价是要有一张像样的显卡,以及一颗愿意折腾的心。

📊 一张表带走

你是谁
更对路的工具
零成本试水
豆包
中文海报 / 自媒体配图
即梦
写实人像 / 带字电商图
可灵
愿意调提示词的玩家
通义万相
追求艺术感、肯付费
Midjourney
想本地部署、自己折腾
Stable Diffusion / FLUX

⚠️ 两个提醒,别踩坑

🚫 坑一:直接拿去商用

AI 生成图的版权规则各家不同、也还在演进。发朋友圈没问题,真要印在包装上、用在广告里,先看清楚该平台的商用条款。

→ 关键词:玩随便玩,商用看条款。
🚫 坑二:出图不看就发

AI 画图不会像文字那样"编造事实",但会犯低级错:手指数量不对、招牌上的字写错、英文单词拼错。发布前自己放大看一眼。

→ 关键词:手和字,出图必查。
✅ 提效:一次出四张,挑一张改

别指望一次命中。让工具一次给四张,挑最接近的那一张,用局部重绘改细节——比反复换工具有效得多。

→ 关键词:改提示词,比换工具更值。
一个比方:工具决定上限,提示词决定下限。同一台相机,会不会构图,拍出来完全是两个世界。明天我们就专门讲提示词怎么写。

🎯 今天的动手作业

拿同一句提示词——比如"一只戴墨镜的柯基在夕阳下的海边冲浪,暖色调,胶片质感"——在两个不同平台各出四张。

对比一下:哪家更懂你的中文?哪家更懂你的审美?这份对比,就是属于你的选型报告,比任何排行榜都准。

📝 今天带走三句话

  • AI 不是拼贴,是去噪:从一屏雪花开始,提示词当导航,几十步擦出一张画——这就是扩散模型。
  • 十二年三步走:GAN 会造图(2014)→ 扩散模型造得好(2020)→ SD/Midjourney 让人人可用(2022)→ 2023 至今,中文理解和"好改"才是主战场。
  • 按身份选工具:免费豆包、中文即梦、人像可灵、调词万相、审美 Midjourney、折腾 SD/FLUX。

🎯 自测三题

  1. 有人说"AI 画画就是从网上找图拼起来的",你会怎么三句话纠正他?
  2. 你要给公司做一张带活动标题的中秋海报,选哪个工具?出图之后还要检查哪两样东西?
  3. 同一句提示词,在 A 平台出图很丑、B 平台却很漂亮,最可能的原因是什么?

📣 Week 6 第二站:原理讲透了

1️⃣ 点个「在看」,标记你的 Day 36

2️⃣ 转发给那个"以为 AI 在拼图"的朋友

3️⃣星标「跟着狐狸学AI」,明天 Day 37 · AI 绘画进阶:Prompt 怎么写才出好图

👉 微信搜索foxforAI· 每天5分钟,90天成为AI科普专家

📖 从头开始

①9/26 Day 35 · AI绘画有多简单?一句话出图,3步改成能发朋友圈
②9/25 Day 34 · ChatGPT、DeepSeek、Kimi 到底用哪个?六大场景,一张表对号入座
③9/24 Day 33 · 国产 AI 三巨头,各打一张牌
📚全部课程(合集)想从头学?点这里
← Day 35 · AI绘画有多简单?一句话出图明天 Day 37 · Prompt 怎么写才出好图

相关学习资料