乐于分享
好东西不私藏

全球AI一周大事记(8.9–8.16):DeepSeek涨价开卷Agent,编程战场三足鼎立

全球AI一周大事记(8.9–8.16):DeepSeek涨价开卷Agent,编程战场三足鼎立
信息截至 2026 年 8 月 16 日,依据公开报道整理,供技术学习与行业观察参考。

8 月 13 日晚到 8 月 16 日,AI 圈只用了四天就把剧情换了一遍:DeepSeek 深夜三连发——正式版上线、宣布涨价、开源 Agent 框架;紧接着智谱发布 GLM-5.3、阿里官宣开源 Qwen3.8 系列;大洋彼岸,Cursor 正式加入 SpaceX,英伟达披露约 634 亿美元持仓,黄仁勋又把「AI 算力」推成独立资产。一个清晰的信号:竞争主线正在从「谁的模型更大」,转向「谁的 Agent 底座更牢、谁的算力家底更厚」。

01 中国军团:Agent 底座开卷

*DeepSeek 三连发:正式版、涨价、开源 Harness*

8 月 13 日晚,DeepSeek 正式上线 V4-Pro(0813)正式版,新增 low、high、max 三档思考强度:简单任务少耗算力,复杂任务允许模型跑得更久。同一晚,官方预告 API 涨价方案,实行峰谷计价,高峰时段是低谷时段的两倍。以 V4-Pro 为例,输入缓存命中价从约 0.0245 元上调到错峰约 0.15 元、峰值约 0.30 元,峰值时段涨幅超过 11 倍;输出价从约 5.9 元上调到错峰约 13.4 元、峰值约 26.8 元,上涨约 3.6 倍。官方解释是「更合理地分配资源」、鼓励错峰调用;市场则普遍解读为算力紧张之下,用价格杠杆分流高峰并发。横向对比,错峰价仍明显低于 GLM-5.2(国内价 28 元)、Qwen3.7-Max 国际站(约 50.8 元)与 Kimi K3(约 101.6 元),但峰值价已接近 GLM-5.2——那个「便宜到没有对手」的 DeepSeek,正在成为过去式。

一个多小时后,DeepSeek 又开源了 Agent 框架 Harness v0.1 开发者预览版(MIT 协议)。核心设计是「一切皆插件」:模型、工具、技能、沙箱甚至界面都可以替换,默认支持近 40 家模型厂商,刻意不锁定自家模型。团队给出的公式是「Model+Harness=Agent」,明确对标 Claude Code,由今年 3 月加入 DeepSeek 的崔添翼带队(浙大毕业,曾在 Jane Street 工作 9 年)。有报道称,Harness 上线当晚 GitHub 星标迅速破万。模型、价格、框架一夜三发,DeepSeek 把 Agent 底座的争夺直接摆上了台面。

*智谱 GLM-5.3:把「编程最强开源」喊出来*

8 月 14 日,智谱发布 GLM-5.3,官方称其为「编程能力最强的开源模型」。基座沿用约 7000 亿参数的 GLM-5.2,提升全部来自后训练 Scaling:内部自建体感评测较 GLM-5.2 提升 50%,在 Terminal Bench 3.0、Agents' Last Exam(CLI)等公开基准中取得开源第一。据智东西报道,在相同的高档位思考预算下,GLM-5.3 准确率 31.5%,超过 Claude Opus 4.8 的 29.5%,平均输出约 5 万 token,不到后者一半。另一个亮点是安全:实测寻获逾千中高危漏洞。智谱决定完整权重在发布两周后开放,先完成安全评估与加固,「尽量限制攻击能力、保留防御价值」。

*阿里:Qwen3.8 系列官宣开源,千问办公当起「模型货架」*

8 月 14 日晚,阿里千问官宣开源 Qwen3.8 系列:Qwen3.8-27B 为原生多模态 Dense 模型,Apache 2.0 协议;同日开放 Qwen3.8-2.4T-A95B 模型权重,这是阿里首次开放 Max 级别旗舰权重。至此千问累计开源 460 余款模型,全球下载量超 30 亿次。8 月 15 日,阿里旗下 Agent 产品「千问办公」在「前沿模型」档位首发上线 GLM-5.3 与 DeepSeek V4 Pro,加上此前的 Qwen3.8-Max,把别家旗舰摆上自家货架——模型竞争卷到这一步,「好用谁家的」比「谁家出的」更重要。

*国家队入场:超算互联网上线 V4 Pro 与 Harness*

8 月 14 日,国家超算互联网宣布上线 DeepSeek V4 Pro 正式版与 Harness,依托全国首个十万卡级超智融合算力资源池,为科研院所、科创企业和开发者提供大模型全生命周期算力支撑。目前其 AI 社区已汇聚 1700 余款开源大模型。

02 海外与资本:工具被收编,算力变资产

*OpenAI:Ultrafast 模式提速 14 倍,年化营收破 400 亿美元*

8 月 14 日,OpenAI 以预览形式为 GPT-5.6 Sol 推出 Ultrafast(超高速)模式,算力由 Cerebras 提供,最高每秒输出约 750 个 token,约为标准模式的 14 倍,主打对时效要求高的任务。同周,据彭博社援引知情人士,OpenAI 年化营收已突破 400 亿美元,较 2025 年底约翻倍,正加速冲刺 IPO。

*谷歌:可见水印可以关,隐形水印关不掉*

8 月 14 日,谷歌宣布 Gemini 应用可关闭 AI 生成图片、视频、音频上的可见水印,但所有生成文件仍强制携带隐形的 SynthID 数字水印与 C2PA 来源元数据,嵌入文件内部、肉眼不可见。这套「表面可选、底层强制」的双轨机制,为 AIGC 溯源提供了一个样本。

*Cursor 正式加入 SpaceX:600 亿美元收编完成*

8 月 14 日监管文件显示交易生效,8 月 15 日 Cursor 官宣:已被 SpaceX 以 600 亿美元正式收购,始于 4 月的收购流程就此完成。Cursor 在博客中写道,周三(8 月 12 日)发布的 Grok 4.6 是双方合作成果的初步展示——Cursor 参与训练了这款模型,而 SpaceX 正在构建所需的计算能力。AI 编程赛道金额最大的并购之一就此落地,开发者最常用的编程工具之一,正式并入马斯克的商业版图。

*英伟达:持仓约 634 亿美元,把算力做成资产*

8 月 14 日披露的 13F 文件显示,英伟达二季度末持仓市值约 634 亿美元:持有英特尔约 2.15 亿股、市值约 300 亿美元,占总持仓 47.3%;持有 SpaceX 约 1.23 亿股、市值约 210 亿美元,占 33.1%;另持有 CoreWeave 等。本周,黄仁勋携手六位华尔街资管巨头同台,为「将 AI 算力打造为独立资产类别」背书,并表示可能为单个投资项目提供最高 25% 的残值支持机制。有分析认为,这标志着 AI 热潮正从技术竞赛延伸到资本竞赛。

03 三句话看懂趋势

1. 主战场从「模型」转到「底座」:Harness、GLM-5.3、千问办公……谁能定义 Agent 的工作流与生态,谁就拿到下一轮门票。

2. 价格叙事反转:低价换规模告一段落,峰谷定价、限时促销、算力资产化相继登场,成本开始向开发者端传导。

3. 算力成为硬通货:SpaceX 收 Cursor、英伟达持仓与残值承诺、OpenAI 冲刺上市,都指向同一件事——AI 的下半场,比的是算力家底与资本纵深。

结语

这一周的信息密度依旧惊人。对普通用户来说,最直观的变化是:好模型的选择更多了,但「便宜到随便用」的红利正在收窄;对行业而言,Agent 底座与算力资产的争夺才刚刚开始。下周大概率还有新东西,持续关注。

本文基于公开报道整理,个别数据以官方发布为准。

*主要参考来源*

▪️ 澎湃新闻:《DeepSeek深夜三连发,梁文锋再放大招》

▪️ 36氪:《DeepSeek的Harness,为何是一头黑色鲸鱼?》

▪️ IT之家:《智谱正式发布GLM-5.3:编程能力最强开源模型,较GLM-5.2提升50%》

▪️ 智东西:《刚刚,GLM-5.3来了!拿下多个开源SOTA,我用它"魔改"DeepSeek Harness》

▪️ 央广网:《又一国产AI大模型宣布开源,国产大模型掀起开源潮》

▪️ 新浪科技:《阿里千问正式开源Qwen3.8系列模型》

▪️ 36氪:《"千问办公"首发上线GLM-5.3、DeepSeek V4 Pro两款模型》

▪️ IT之家/钛媒体:《DeepSeek V4 Pro正式版、Harness上线国家超算互联网》

▪️ DoNews:《OpenAI 推 Ultrafast 模式,GPT-5.6 Sol AI 提速 14 倍》

▪️ The Next Web:OpenAI's new Ultrafast mode runs GPT-5.6 Sol 14 times faster, on Cerebras chips

▪️ PChome:《谷歌允许用户关闭AI生成图片水印,同时保留隐形标记》

▪️ Cursor 官方博客:《Cursor 现已成为 SpaceX 的一部分》

▪️ 界面新闻:《英伟达二季度末持仓市值634亿美元,新增持有SpaceX》

▪️ 钛媒体/央视财经:《黄仁勋出手安抚AI算力市场:英伟达可能会"为单个投资项目提供最高25%的残值支持机制"》