今天一早,安全圈有人扒出一个事,看完我后背有点发凉。xAI 官方的 Grok CLI,就是那个你 npm 装一下就能在终端里用的 AI 编程工具,被抓到在每次干活前后,把你当前整个工作目录打包,连着目录外的 Claude 配置、全局 Agent 规则、三十多个 Skill 文件,还有一个 API 密钥,通过一条旁路通道静默传到了 xAI 的 Google Cloud 仓库。最离谱的是,哪怕你只是让它回一个单词,上传一样发生。
我就一个感觉,你以为你在用工具,其实是工具在拿你。
先把这个事说透。

Grok CLI 这个 0.2.93 版,会生成两个压缩包,一个叫 before_codebase,一个叫 after_codebase,分别在任务前和任务后上传。验证的人发现,上传的内容不限于你打开的项目,连你家目录下的 .claude.json、Claude Code 的设置、那些 Agent 规则全在里面,等于把你的开发环境连同钥匙一起寄走了。七月十三号凌晨,xAI 才通过服务端远程开关加了个 disable_codebase_upload 字段,把默认上传关掉。注意,是默认开着,被扒出来才关。
这不是第一次了。之前 Grok Build 那个 CLI 就被发现把整个仓库和 git 历史传上去,这次更过分,直接带走了密钥和配置。一个官方发布、正经上架的 AI 工具,默认行为是偷传用户敏感文件,这已经不是 bug,是信任的裂缝。我是真觉得,往后选 AI 编码工具,得把「它在后台连了什么」当成头等大事,开源可审计会越来越值钱。

然后看算力这边,今天黄仁勋在摩根士丹利路演上放的话,分量不轻。
他说英伟达这个季度营收就要摸到一千亿美元,而且增速还在加快。一千亿季度,一年就是四千亿级别的体量,放在任何行业都是怪物。他还顺手否认了 Rubin Ultra 延期的传闻,说下一代旗舰按计划在明年出货,现在的机架调整只是系统优化。
但我更在意他顺带提到的一个信号。有个原本主要依赖自研 ASIC 芯片的前沿 AI 项目,现在英伟达 GPU 的算力占比已经接近一半,市场普遍指向 Anthropic。你们记得前两年大家都在喊自研芯片、去英伟达化吗,博通、谷歌、各家都在囤 ASIC。结果最前沿的那家,悄悄把一半算力搬回了 GPU。这让我想到,自研芯片的叙事在现实面前退了一步,Nvidia 的护城河比想象中更难绕。它下一步还要用 Vera CPU 杀进通用服务器市场,从 GPU 霸主往整个数据中心地基扩。算力这盘棋,集中度的天花板还在往上顶。

再说模型这边,今天有个真实的生产案例,比任何基准测试都实在。
做 AI 营销网站的 Ploy,把他们智能体的默认模型从 Claude Opus 4.8 换成了 OpenAI 刚发的 GPT-5.6 Sol。数字很漂亮,建一个页面的平均耗时从八分钟压到三分多钟,快了两倍多,每次构建成本从三块多美元降到两块出头,视觉评分还略升。但迁移过程踩了个坑,特别值得做 Agent 的团队记下来。GPT-5.6 会自作主张给全部二十五个工具参数都填上默认值,结果一半以上的文件读取直接返回空。提示词改不了,OpenAI 的 strict 模式也压不住。也就是说,换模型不是换个名字,是换了一整套行为脾气,评估框架里三分之一的失败其实是旧假设在作怪,不是模型不行。
顺带一句,OpenAI 今天还给 Codex 和 ChatGPT Work 暂时取消了五小时使用限制,说 GPT-5.6 Sol 整体更省,用量会降下来。两条放一起看,信号很清楚,前沿能力在变便宜、在放开闸口。对咱们做产品的,好消息是单位智能成本又往下走,坏消息是模型迭代太快,今天调好的活明天可能就变样。

再补一条国内的。腾讯混元发了 Hy3,二百九十五亿参数、二十一亿激活的 MoE 架构,定位是 Agent 向的大模型,已经接进微信服务十亿以上的用户。官方说在内部 WorkBuddy 任务上成功率从七成二拉到九成,耗时降三成四。纯视觉还是短板,但 coding、办公、复杂规划这几块能打。大厂把前沿模型压进超级 App,这条路国内走得很实了。
聊完这几条,我想拉远一点。
今天这几件事,表面各说各话,底下其实一条线。xAI 的工具在后台拿你的东西,Nvidia 的算力在往一处收,模型在变便宜却在变任性,腾讯把大模型塞进十亿人的微信。AI 正在从你手里的工具,变成既替你干活、又伸手拿你、还自己拿主意的角色。能力越强,越要把绳子攥紧。
既然看到这里了,如果觉得有点意思,随手点个赞、在看、转发三连吧。我们,下次再见。
夜雨聆风