今天最值得关注的一件事:Google 官宣 Imagen 4 将于 8 月 17 日关停,图像生成全面切到 Gemini 3 家族(Nano Banana 2 / Pro)——用 Google 系出图的人,该把工作流提前迁过去了。
01ComfyUI MCP 批量生成更新:一次最多 50 个任务
7 月 10 日,ComfyUI 官方更新了 MCP 工具——新增批量生成 skill,一次最多提交 50 个任务,大幅省 Token、提效率;官方 skill 现已在 OpenClaw 中可用;还支持把工作流一键转成 APP Mode、创建可分享的 APP。这意味着你可以用自然语言(Claude / Codex / Cursor)驱动 ComfyUI 跑批量出图,不用手动一张张点。
怎么用:跑批量海报、多角色设定图、A/B 测试提示词的人,把 ComfyUI 升到最新版接上 MCP,直接一句"生成 50 张不同配色的电商主图"丢后台跑,省下的时间喝杯咖啡。
02Google Imagen 4 退场,Gemini 3 图像家族接班
Google 重组了图像生成产品线——Imagen 4 和 Imagen 4 Ultra 将于 2026 年 8 月 17 日 正式关停,由 Gemini 3 图像家族 接棒。新体系里,Nano Banana 2(即 Gemini 3.1 Flash Image)已全量可用,出图 512px 到 4K,在 Gemini App 里免费;上面的付费旗舰是 Nano Banana Pro(Gemini 3 Pro Image)。最强卖点是角色 / 物品一致性——最多 5 个角色、14 件物品在多次生成间保持稳定,正好对症角色设定图和连载内容。
怎么用:依赖 Imagen 出图(尤其 Vertex AI 流水线)的团队,8 月前把调用迁到gemini-3-1-flash-image或gemini-3-pro-image;做角色设定集的,直接用 Nano Banana 2 的多角色一致性,省去后期拼贴。
03gpt-image-2 的"思考后生成"强在哪
OpenAI 的 gpt-image-2(ChatGPT Images 2.0,4 月发布)是目前 LMArena 文生图 + 图像编辑双榜第一。杀手锏是生成前先推理(Images with Thinking)——先把你的需求拆解、规划构图、必要时联网校准,再出图。所以复杂简报(精准信息图、密集多语言文字、带约束的产品镜头)一次做对的概率高很多;带文字的图渲染也准。Thinking Mode 需要付费 ChatGPT 套餐,免费档只能 Instant 模式。
怎么用:做带大段文字的营销图、多语海报、需要"一次画对"的精密配图,优先 gpt-image-2 的 Thinking 模式;API 价格约 $0.006(低质)到 $0.21(高质)/张,预算紧的大批量慎用。
04Cursor v3.11 Side Chats:主聊旁开持久侧边对话
Cursor 7 月 17 日更新到 v3.11,最大变化是 Side Chats:在主对话旁边开一个持久的侧边 agent 对话,共享主聊上下文,还能用 /side 或 /btw 唤起、用 @ 把侧聊结论拉回主线程。另外加了 5 个云 agent 钩子(beforeSubmitPrompt、afterAgentResponse 等),方便把 agent 工作流接进 CI / 通知。
怎么用:主线程写代码、旁边开个 Side Chat 让它单独调研某个模块或写文档,互不干扰;团队把钩子接到 PR 通知,agent 跑完自动播报,不用手动刷。
05Claude Code v2.1.206:目录、体检、一键 PR
Claude Code 近期到 v2.1.206,加了一串实操命令:/cd 给目录路径建议、/doctor 做体检并能自动修剪臃肿的 CLAUDE.md、/commit-push-pr 一键把改动提交并推 PR;升级后还会自动更新后台 agent。早一点的 v2.1.205 则锁死了"auto 模式不能改会话记录文件"。
怎么用:长项目里用/doctor定期清理 CLAUDE.md,避免上下文越攒越慢;小改动直接/commit-push-pr走完流程,省掉切终端的功夫。
🎨 今日AI美术小课堂
周二 Stable Diffusion 实操:ControlNet 锁姿态,让角色"换装不换动作"
周二固定栏目,今天讲 SD 的 ControlNet 一招——固定人物动作。用 openpose 预处理器从参考图提取骨架,作为 ControlNet 输入;之后改提示词换服装 / 场景,人物姿势保持不变。
🔹 用法:在 WebUI / ComfyUI 加一个 ControlNet 单元,预处理器选 openpose,对应模型 control_v11p_sd15_openpose,正常写提示词即可。
🔹 适合:角色设定集、电商模特多姿态、连环画分镜——一套骨架批量出同人设图。
💡 一句话总结:姿态交给 openpose,长相和衣服交给提示词 + LoRA,批量出图不串味。
以上就是今天的AI工具日报。
觉得有用,转给身边搞设计和写代码的朋友,明天见 👋
夜雨聆风