8 月 20 日,国产大模型的主战场从「谁的榜单更高」彻底转向「谁先把模型放進用户的电脑、缝进真实工作流」。字节豆包在 8 月 18 日「虚拟桌面」之后再推「本地/云电脑双模式」,让 AI 既能在本地私密干活、也能关机上云持续跑任务;智谱 GLM-5.3 凭后训练 Scaling 把编程与网络安全推到开源第一,并启动「开源的盾」计划、同时回 A 上市,把安全能力变成公共品。腾讯 WorkBuddy、阿里千问则在办公入口与开源生态两条线上持续落子——国产阵营正在用「入口 + 生态 + 安全」三线并进,把与闭源头部的差距压到肉眼难辨。
1腾讯 WorkBuddy:人机双写 + AI 支付闭环,办公底座稳迭代WorkBuddy 把「办公」延伸到「生活服务」:5.3.5 版本联合腾讯文档推出面向 Agent 时代的 「人机双写」 协同编辑——用户与 AI 在同一份文档里共同创作、就地修改,改动直接落回原文件,兼容 Word、Excel、PPT、Markdown,并打通本地 Office 与腾讯文档;更关键的是接入微信支付的「AI 支付」能力,用户可在产品内完成从需求提出、智能推荐到下单支付的完整链路,肯德基已成为生活专区首个西式餐饮合作品牌。产品侧则稳迭代:5.3.8 起三端(PC/App/小程序)同步、5.3.11「活页面」轻应用(HTML 关联 CSV 双向同步、Markdown 审阅、移动端远程监工)、5.3.12 锁屏远程弱网稳定、5.3.13「一键做同款」套版复刻,以及 5.0+「安全中心」(实时拦截越权操作、删除文件自动入回收站、文件版本还原)已陆续落地。
· 二季报定调 WorkBuddy 为「中国明确领先的 AI 办公生产力服务」,已落地 50+ 行业、7 万+ 技能· 易观 Q2:PC 端月访问 2097 万次 国内第一;腾讯 AI 资本开支同比 暴涨 176% 至 528 亿元· 混元 Hy3 调用量较发布初增 68 倍 登顶 OpenRouter,Hy4 近期发布
2字节 豆包:虚拟桌面之后,本地/云电脑双模式破圈
8 月 18 日至 19 日,豆包 PC 端「工作任务」模式密集更新,先后上线虚拟桌面、手机遥控和 本地/云电脑双模式 三项能力,把 AI 办公 Agent 从「问答助手」推向「独立干活的执行者」。虚拟桌面基于「口优先、GUI 兜底」策略:对开放接口的软件直接调接口,无接口的应用则靠识别屏幕、模拟鼠标键盘完成操作,运行在隔离环境、不抢用户鼠标键盘、不打断当前工作;8 月 19 日新增的双模式则兼顾数据安全与持久运行——本地模式数据留在本机、适合处理内部文件,云电脑模式提供独立云端环境,任务发起后即使关掉本机也能持续执行,适合长时间采集与定时监测,用户可随时用手机查看进展。接入飞书办公生态后,豆包可调用文档、表格、PPT 等在线技能,实测中 7 份采购合同被逐条比对法务红线清单,金额大小写不一致、付款比例异常、账号末三位颠倒等 8 处问题均被识别并标注风险等级。
据行业数据,内地 AI 办公桌面端月活已突破 3000 万。豆包两日内连推三功能,被业界视为「下一代 AI 办公入口」争夺的关键落子——谁先让 AI 像人一样用电脑、又能在用户不在场时持续跑,谁就握住了办公自动化的入口。
3阿里 千问:Max 级开源 + 27B 稠密小杯,办公入口聚模型
在 Qwen3.8-Max(2.4T)权重开源、全球下载破 30 亿、中国开源模型下载占比 41% 首超美国之后,阿里本周把千问生态继续压实:Qwen3.8-27B 是 270 亿参数的原生多模态稠密(Dense)模型,支持图像与视频理解、原生上下文 262K 可外推至 1M,采用 Apache-2.0 协议,量化后在消费级显卡即可运行,多项成绩超过参数更大的 Qwen3.7-Plus,部分基准(SWE-bench Pro、OSWorld-Verified)甚至超过 Claude Opus 4.6 Max,被海外称为「本地 Opus 4.6」。更值得关注的是入口侧的 模型聚合:8 月 14 日晚,千问办公、百度库库 AI 等头部办公 Agent 上线模型聚合,接入智谱 GLM-5.3 等外部模型,国内办公 Agent 正式进入「多模型任选」阶段。连同早前的 Qwen-Image-3.0、Qwen-AgentWorld 语言世界模型与 Qwen-Robot Suite 具身套件,千问正把生态从文本/图像扩展到「会行动的智能体」与「能动的机器人」。
4智谱 GLM-5.3:开源编程封王,回国上市与安全并行
8 月 14 日,智谱发布 GLM-5.3(7530 亿参数):基座与 GLM-5.2 一致,却靠极致后训练 Scaling 把智能上界推高——编程较上代提升约 50%、Terminal-Bench 3.0 等基准取得开源第一,在白盒代码审查与漏洞发现上持平闭源旗舰 Mythos 5;网络安全评测 CyberGym 拿下 84.5%,高于 Mythos 5(83.8%)与 GPT-5.6 Sol(83.6%)。最惊艳的是实战价值:智谱联合清华等安全团队借助 GLM-5.3,在诞生于 1983 年的 DNS 协议中发现了潜伏 40 余年 的关键漏洞,攻击者可借少量特殊请求把服务器压力放大近 8 万倍,影响超 1000 万处公网 DNS 服务。同步启动的「开源的盾」计划,对重点开源项目持续安全审计、免费为社区提供审计算力,并计划两周内开源完整权重——把前沿安全防御能力变成全球开发者可平等获取的公共品。
资本侧,被称为「全球大模型第一股」的智谱启动回 A,完成约 314.1 亿港元 配售,与 MiniMax 共同采用「港股先行、A 股跟进」模式;摩根大通、招银国际分别因 GLM-5.3 发布与 DeepSeek 提价上调其目标价。同周国产阵营其余力量:DeepSeek V4 Pro 峰谷定价 8/17 生效(高峰输出 27 元/百万 Token、较此前涨约 350%),其 Harness 框架以 MIT 协议开源;Kimi K3(2.8T,史上最大开源)ARR 约 3 亿;MiniMax M3(4280 亿全模态)SWE-Bench Pro 59.0% 超 GPT-5.5,2.7 万亿的 M3 Pro 将于 9 月发布。斯坦福《AI Index 2026》结论:中美模型性能差距已「实际上消失」。
一句话总结:国产阵营的共识,已从「谁的榜单高一分」转向「谁能把模型放進用户手边、缝进真实工作流、并守住安全底线」。腾讯用活页面 + AI 支付把办公做成闭环,字节用虚拟桌面 + 云电脑把豆包推进电脑与飞书入口,阿里用 Max 开源 + 27B 小杯 + 模型聚合把 Qwen 推向入口与设备,智谱用 GLM-5.3 + 开源的盾把安全变成公共能力——下一阶段比的是耐力、渠道与生态,而不再是单点跑分。
本文由 AI 检索整理,数据来源于公开报道,截至 8月20日。如有偏差请以官方发布为准。
夜雨聆风