乐于分享
好东西不私藏

AI 情报速递 · 5 月 30 日

AI 情报速递 · 5 月 30 日
今天六条。一条炸得最响,五条都指向同一个方向。

1. xAI 放弃 NVIDIA JAX,转而用 Grok Build"氛围编程"自研训练框架

这是今天最炸的消息。SemiAnalysis 爆料:xAI 已经正式放弃 JAX GPU 训练堆栈,转而自研 C 语言训练框架——而且是用自家的 Grok Build"氛围编程"写的。
细节更劲爆。xAI 的 JAX 堆栈 MFU(模型浮点利用率)不到 10%。不是 80%,不是 50%,是不到 10%。这意味着他们花了几十亿美元买 GPU,实际用上的不到十分之一。NVIDIA 的 JAX 团队过去两年全部主力 996 专门支持 xAI,结果失败了。SemiAnalysis 的原话是:"我想他们现在可以休息并兑现期权了。"
xAI 是 NVIDIA GPU 最大的客户之一。最大客户公开放弃你的软件栈,自研替代方案——这对 NVIDIA 的 CUDA 生态来说,是一道裂痕,不是一条划痕。
锐评:这件事的严重程度怎么强调都不为过。过去十年,NVIDIA 的护城河不是硬件,是 CUDA + 软件生态。现在最大的客户之一说——你的软件太差了,我宁愿自己写一个。更讽刺的是,替代方案是用 AI 写的。"氛围编程一个 C 训练框架"这句话,既是 AI 能力的展示,也是对传统软件工程模式的嘲讽。xAI 和 NVIDIA 的合作不会就此终结——GPU 还是得买。但议价权和话语权,正在从卖铲子的人手里,往买铲子的人手里滑。

2. 阿里云 Qwen 拿下 UEFA 全球 AI 合作伙伴,一签就是六年

阿里云和 Qwen 昨天宣布成为 UEFA 官方独家 AI、云计算与电子商务合作伙伴。合同覆盖 2027/2028 至 2032/2033 共六个赛季的 UEFA 男子俱乐部赛事,以及 UEFA EURO 2028。蔡崇信亲自站台,说将投入云计算、全栈 AI 及全球电商平台能力。
这意味着 Qwen 大模型将被部署到 UEFA 的球迷互动、媒体内容体验、沉浸式观赛等场景。欧洲足球的最高舞台,第一次有了中国 AI 的深度嵌入。
锐评:上周我们写 Qwen3.7-Max 登顶 OpenRouter 全球热榜,结论是"中国 AI 技术追上来了"。今天这条消息说明——不只是技术追上来了,商业化也找到了高级战场。体育赛事是品牌全球化的终极载体之一。Qwen 选择 UEFA 而不是国内赛事,说明它要打的不是"国产替代"牌,是真正的全球品牌牌。这跟 DeepSeek 选择 A 股科创板,是两条完全不同的国际化叙事。

3. Cognition CEO 也改口了:"AI 编程智能体不应取代人类"

连续第三天,AI 行业领军人物的"替代论"在集体撤退。
5 月 27 日,Altman 承认 AI 对白领冲击没那么严重。5 月 29 日,Amodei 收回 AI 就业末日预言。5 月 30 日,轮到 Cognition 的 Scott Wu——做 Devin、年收入近 5 亿美元、全世界最成功的 AI 编程智能体公司的 CEO——公开说"AI 编程智能体并非旨在取代人类程序员"。
做 AI 编程智能体的人,说 AI 编程智能体不应该取代程序员。这句话的认知冲击,比 Altman 和 Amodei 的改口加起来都大。
锐评:如果一个卖伞的人说不会下雨,你可以怀疑动机。但如果连卖伞的人都这么说了——那可能真的要想想,自己之前被淋的雨,是不是有人故意把水管对着你喷。Altman、Amodei、Scott Wu,三个人改口的时间线排在一起,不像巧合。更像是行业在集体调校叙事方向。从"AI 要抢你饭碗"到"AI 是来帮你的"——这不只是换一句话,是换了一套面向公众、监管和投资者的整体话语体系。

4. Kog 团队把推理速度拉满:3000 tokens/秒

Kog 团队昨天展示了一个让人下巴掉下来的数字:在 8×AMD MI300X GPU 上,单用户推理速度达到 3000 tokens/秒。对比一下,常规推理速度大约在 100-300 tokens/秒。这是 10 到 30 倍的提升。
技术路径也很有意思。他们没有换 GPU,没有换模型架构,而是从根本上重新思考了 LLM 解码——把它视为一个"内存流"问题。通过协同设计 monokernel、重建同步机制、针对性的内存访问映射,以及一种叫 Laneformer 的延迟张量并行架构,把传统流程中的阻塞点全部消除。在 NVIDIA H200 上也跑到了 2100 tokens/秒。
锐评:3000 tokens/秒是什么体验?GPT-4 写一篇 1000 字的文章大概要 10-20 秒。在这个速度下,0.3 秒。你还没读完上一句,下一篇已经写完了。这不是"推理变快了",是交互模式变了。当响应速度快到人类感知不到延迟的时候,AI 就不再是一个"你问它答"的工具——它变成了一个你思维中的实时存在。这件事的 UX 意义,比 benchmark 数字重要得多。另外注意:最好成绩跑在 AMD 卡上,不是 NVIDIA。

5. OpenAI 发布实时翻译专用模型,并说了一句意味深长的话

OpenAI 昨天推出了 gpt-realtime-translate:支持 70 多种输入语言,翻译成 13 种输出语言,已经跑在智能眼镜上。这是一个语音到语音的实时翻译系统。
但最值得注意的不是性能。是 Greg Brockman 在推文中说的一句话——"大语言模型很棒,但特定用例需要专用模型。"
这句话从 OpenAI 总裁嘴里说出来,分量不一样。
锐评:OpenAI 从"一个模型统治一切"的 AGI 叙事,到承认"特定用例需要专用模型"——这不是技术转向,是哲学转向。过去五年 OpenAI 的核心信仰是 scale 能解决一切。现在他们自己在做小型的、专用的、面向一个具体场景的模型。这对整个行业的信号是:通用大模型不是终点,是起点。真正的商业价值,藏在那些被通用模型覆盖不足的缝隙里。

6. "AI 精神病":科技裁员 2026 年已接近 2025 全年

TechCrunch 昨天发了一篇文章,标题直白:《当公司过于"AI 上瘾"时会发生什么?》。Box 创始人 Aaron Levie 用了一个新词——"AI psychosis"(AI 精神病)。他的定义是:决定用 AI 替代员工的人,往往最不了解工作的实际内容。
同期数据:项目管理平台 ClickUp 为部署 AI 智能体,刚刚裁了 22% 的员工。2026 年还没过半,科技行业的裁员规模已经接近 2025 年全年。
一边是 CEO 们集体改口说 AI 不会替代人类。一边是企业用 AI 替代人类的动作在加速。
锐评:今天六条新闻,我把这条放在最后,因为它把所有线索串起来了。CEO 们公开说"AI 不抢饭碗",企业私下在裁人。xAI 放弃 NVIDIA 软件栈——不是被更先进的软件替代,是被自己的 AI 写的软件替代。Kog 把推理加速了 30 倍——速度快到人不需要参与。OpenAI 在做专用模型——不是通用智能,是具体场景的自动化。每一条单看,都是技术进步。合在一起看,指向同一个方向:替代不是线性的,是点状的、具体的、一个个岗位地发生。Altman 说"没那么严重"——可能不是撒谎,是他自己也没看清楚这场替代的真实形态。

快讯速览

阶跃星辰"小即是美"新模型预告:暗示将发布小型开源多模态模型,具体参数未披露。
ComfyUI 接入 OpenRouter:直接在 Comfy 工作流里调 20+ 模型,图像生成 + LLM 一站式。
Codex Windows 支持上线:计算机使用功能登录 Windows,手机端可远程管理和引导任务。
OpenRouter 支持模型生成文件补丁:通过 Responses API 用 V4A diff 格式,服务器端验证语法。
Runway API 持续扩展:Seedance 2.0、GPT Image 2、Nano Banana Pro 等均可用一个 API 调取。
Tiny-vLLM 开源:C + CUDA 写的轻量级 LLM 推理引擎,GitHub 已开源。
GPIC 大规模视觉生成基准数据集:李飞飞发推站台,适合现代生成模型时代的新基准。
今日情报小结:xAI 公开抛弃 NVIDIA JAX 软件栈,阿里 Qwen 拿下 UEFA 六年全球合作,Scott Wu 加入"AI 不替代人类"的 CEO 改口阵营,Kog 把推理加速 30 倍,OpenAI 承认专用模型比通用模型更适合某些场景。今天这六条新闻,单看每一条都是行业进展,合在一起读,是一篇关于"替代"的深度调查报告。
你对哪条最有感觉?留言。
数据来源:SemiAnalysis、X、TechCrunch、阿里云官方、OpenAI、Kog