乐于分享
好东西不私藏

OpenAI 连夜删了 52 个 PR,结果 GPT-6 的代号还在 GitHub 上裸奔

OpenAI 连夜删了 52 个 PR,结果 GPT-6 的代号还在 GitHub 上裸奔

昨天,OpenAI「义父」Tibo 在 X 上扔了张四行清单,最后一行写着:Codex 将拥有 Astra。

全网直接炸了。Polymarket 上 "OpenAI 本周发布下一代 Astra" 的概率,几小时内飙到 52%。

但真正的猛料,不在 Tibo 的推文里 —— 在 GitHub 的 commit 历史里。

删不干净的尾巴

AI 大 V Chetaslua 扒出了一个时间差。

8 月 7 日,OpenAI 刚发完那篇让安全圈集体屏息的博文 ——Astra 可能触及网络安全 "Critical" 最高风险等级 —— 仅仅两个半小时后,有人开始批量操作:把内部检查点代号 "mewfour" 从 52 个 PR 里逐一清除。

动作很干净。但没干净到底。

六天后,8 月 13 日,"mewfour" 这个名字再次出现在 openai/codex 仓库的 commit 记录中。随它一起暴露的,还有 PR 的审查方式 ——"独立自动审查",推理档位直接拉到 xhigh,目前已知的最高思考级别。

截图里的工作界面更有意思:会话管理、连接器、技能、插件、自动化流程,一个完整的 AI 工作台。而 mewfour 在上面审的,全是 ChatGPT 即将上线的核心 UI 组件。

OpenAI 员工自己也绷不住了。Codex 研究员 SIGKITTEN 连发四个 Codex 加两个 Tibo,开发者 Haider 一通演算,直接算出 8 月 20 日 —— 也就是本周四 ——Astra 上线。

Tibo 随后发了首一三二四句押韵的小诗,没人破解得了内容,但氛围已经到位了。

2000 美元,十个十年难题

Astra 到底有多强?答案早在 8 月 1 日就摆出来了。

那天 OpenAI 发了篇 249 页的数学论文。Astra 的内部版本,一口气解决了 10 个至少十年没有进展的数学与理论计算机难题,横跨高维几何、编码理论、群论、量子复杂性、格密码学、极值组合学。

其中包括首个非 sofic 群的显式构造 ——Gromov 提出来后,数学家追了 27 年没拿下的问题。

所有证明都以 Lean 4 机器可验证证书的形式,开源在 openai/ten-proofs 仓库里。

最刺眼的数字不是论文页数,是账单。按 GPT-5.6 Sol 的 API 费率算,生成这十个解答的 token 成本,大约 2000 美元。

一台中端笔记本的价钱,换十个困扰学界十年以上的突破。

强到自己按下暂停键

然后就是 8 月 7 日那篇博文。

OpenAI 自己说:初步评估无法排除 Astra 达到 Preparedness Framework 下的网络安全 Critical 阈值。Critical 是什么概念?模型能独立识别并开发零日漏洞,能针对加固目标制定并执行端到端攻击策略 —— 不需要人给具体步骤。

这是有史以来第一次,有实验室因为模型的自主网络攻击能力,主动暂停开发、隔离权重、引入外部机构复审。

Sam Altman 的回应很简短:Astra 非常强大,我们会做好安全准备,然后让所有人都能用上。

真正的变量:从预训练就开始多智能体

The Information 此前的报道点出了 Astra 最根本的不同 —— 它不是一个 "更聪明的聊天机器人",而是从预训练阶段就被训练为让多个智能体长时间协同解决复杂问题。

传闻约 10 万亿参数,MoE 架构,基于内部代号 "Doug" 的预训练项目构建。泄露信息称其在推理、编码、写作、知识、多模态和智能体任务上全面超越 Claude Fable。

这意味着什么?看 GPT-5.6 家族已经搭好的架子就懂了:Sol、Terra、Luna 三个模型分层协作,v2 系统让 Sol 和 Terra 并行时互相通信,Codex 上周刚把 Luna 加进来当子智能体。

技术分析师 Dan McAteer 说得直白:如果 Astra 是在原生多智能体框架里预训练出来的,它天生就具备长时程协作能力,开箱就能在 Codex 里调度多个智能体,把轻活派给更便宜的 Luna。这是当前架构打多少补丁都做不到的 —— 就像当年 Claude Code 在智能体编码上的破局,直接换掉了一整套底层逻辑。

现在 OpenAI 员工已经在公开喊 Astra 的名字了。

问题只剩一个:周四见,还是下周见。