今天最值得关注的一件事:阿里 7 月 21 日发布 Qwen-Image-3.0,把出图指令长度拉到 4.5k token——以后可以像写需求文档一样把画面结构、文字、排版一股脑丢进去,复杂 UI 和带公式的知识图解也能一次画对。
01Qwen-Image-3.0 发布:出图指令拉到 4.5k token
阿里 7 月 21 日推出千问图像生成第三代基础模型 Qwen-Image-3.0。核心变化是支持的提示词长度飙到 4.5k token(约 4.5 倍提升),你不用再把需求压成一句话,而是能像给设计师写 brief 那样,把画面结构、文字内容、排版细节一次性说清。它还能一次生成含公式、几何图、逻辑推导的多元素知识图解,连 10px 小字都渲染清晰,原生支持 12 国语言、20 多款字体,甚至仿真网页 / 游戏 / 直播 UI。
怎么用:做多语产品海报、复杂信息图、试卷 / 分镜这类"可读可用"商业素材的,去阿里云百炼或千问 AI 平台申请 API 邀测;Qwen Studio 和千问 APP 也快上线免费体验,到时直接网页试。
02Midjourney V8.2 预览版:光影材质再上一层
Midjourney 通过 --preview 参数开放了 V8.2 预览版测试。社区创作者实测反馈,新版本在光影质感、材质细节、多物体复杂构图上比 V8.1 更稳;同时 Big Batch Draft Mode 升级,已支持 --sref random,一次出 24 张不同风格图快速探索方向。注意它仍是预览阶段,结果可能不稳定,官方会持续调。
怎么用:想在 V8.1 基础上尝鲜的,在提示词后加--preview即可体验;批量探索风格用--sref random配合 draft 模式,省一半快速工时。
03字节 Seedance 2.0 Mini:低成本多镜头视频
字节的 Seedance 2.0 Mini(影视工具包)已在 ComfyUI 上线,操作节点与原版一致但单次渲染成本更低。它支持 480p / 720p,能生成节奏连贯的多镜头成片,跨镜头人物形象高度统一,也支持文本生成自定义场景构图与视觉风格——小团队做短视频、分镜预演很划算。
怎么用:把 ComfyUI 更新到 0.27.1 以上装 Seedance 2.0 Mini 节点,先 480p 快速出多镜头分镜确认节奏,再挑满意的镜头升 720p,成本压到最低。
04GitHub Copilot 接入 GPT-5.6 全家桶
GitHub Copilot 7 月把 OpenAI 的 GPT-5.6 三档模型(Sol / Terra / Luna)接进模型菜单,覆盖 VS Code、CLI、网页、移动端等全场景;同时上线了首个原生可选的开源权重模型 Kimi K2.7 Code(跑在 Azure 上),给常规活儿一个低成本替代。等于 Copilot 从一个补全工具,变成了能按需切模型的"模型分发层"。
怎么用:模型选择器里把日常活儿切到Kimi K2.7 Code省预算,硬仗再换GPT-5.6 Terra/Luna;企业管理员能在策略里开启开放权重模型,放心纳入团队流程。
05Cursor 移动端 iOS 公测:手机远程跑 agent
Cursor 的移动端 App 已向全付费计划开放公测。它不是单纯代码查看器,而是个 agent 指挥台——能直接从 iPhone 启动常驻 cloud agents(跑在隔离虚拟机里,能测能验能演示),还带 Remote Control 远程管理桌面上的本地 agent,支持语音输入和 slash 命令。合上笔记本也能推进长任务。
怎么用:手机上把耗时的重构丢给 cloud agent 后台跑,出门用 Remote Control 看进度、回消息;零散想法直接语音转 slash 命令下发,不用守着电脑。
🎨 今日AI美术小课堂
周三 ComfyUI 工作流:用 Group Node 把常用模块打包复用
周三固定栏目,今天讲 ComfyUI 一个提效基本功——Group Node(节点组)。搭复杂工作流时,把"加载模型 + 采样 + 放大"这类常用一串节点框选,右键打包成一个节点组,下次直接拖出来用,参数暴露在组内一目了然。
🔹 做法:框选要打包的节点 → 右键 Group Nodes → 命名保存;之后在节点库里搜名字就能复用,也能导出给同事。
🔹 适合:固定出图流水线、团队共享模板、把 MJ/SD/视频节点拼成一条龙——一次搭好,处处省力。
💡 一句话总结:重复三遍以上的节点串,就值得打包成 Group Node,别每次手搓。
以上就是今天的AI工具日报。
觉得有用,转给身边搞设计和写代码的朋友,明天见 👋
夜雨聆风