乐于分享
好东西不私藏

OpenAI绝密代号"Doug"泄露!碾压GPT-6,让Anthropic看起来像"原始人",年底核弹级模型正在训练

OpenAI绝密代号"Doug"泄露!碾压GPT-6,让Anthropic看起来像"原始人",年底核弹级模型正在训练

一个土得掉渣的人名,搅动了整个AI圈的八月。

2026年8月7日深夜,半导体与AI产业最硬核的研究机构SemiAnalysis,在一篇讨论Google DeepMind人才流失的万字长文里,不经意地塞进了一条重磅消息,

"OpenAI has overcome their pre-training issues, and a much larger model code named 'Doug' is actively in the works."

(OpenAI已克服其预训练问题,一个规模大得多、代号"Doug"的模型正在积极推进中。)

▲ SemiAnalysis文章中,橙色高亮处清晰可见"Doug"代号首次出现在产业研究的公开表述中

而故事最刺激的部分是:泄露它的人,自己也搞错了。

"预训练停滞两年半",Doug出场前的至暗时刻

要理解Doug为什么炸,你得先理解OpenAI过去两年半经历了什么。

打个比方: 训一个大模型分两步预训练像通识教育,把人类文明的海量文本喂进去,让模型学会语言、常识和推理的"底座";后训练像职业培训,教它怎么对话、怎么用工具、怎么在考试里拿高分。

自2024年GPT-4o发布以来,OpenAI在预训练这条主线上,几乎停滞了整整两年半

▲ 2025年末,多家媒体转述SemiAnalysis判断:OpenAI自GPT-4o后未能完成新一代前沿底座的预训练部署

他们想训,却一度训不动万卡集群的失败率、跨数据中心的梯度同步噩梦、高质量数据的枯竭、更大MoE架构的超参数搜索,每一道坎都足以让一次耗资数亿美元的训练跑崩。

GPT-4.5(代号Orion)是最惨烈的前车之鉴。确实是当时最大的预训练底座,定价高达75/150美元(每百万token输入/输出),然而智能提升肉眼可见地令人失望钱花了,效果没到,整个行业开始怀疑:Scaling Law难道撞墙了?

于是OpenAI转向了另一条路,不换底座,拼命打磨后训练和推理链o1系列、GPT-5.6-Sol……能力确实在涨,但产业分析师们心里都清楚:后训练的边际收益迟早会薄到透明。

底座不换,天花板就在那里

一声惊雷:Chris说"它会让Fable看起来像原始人"

2026年8月8日,X上一个叫Chris(@ChrisGPT)的泄露追踪者,发出了一条让整个AI社区集体窒息的帖子。核心信息有四点:

  • GPT-5.5不会是OpenAI最后一次重大预训练;
  • GPT-6会很强;
  • 但他六月就暗示过的年底模型,才是OpenAI有史以来最大规模的预训练
  • 这个模型的代号叫Doug它会让Fable(Anthropic的前沿模型)看起来像"primitive(原始人)"。

▲ ChrisGPT关于Doug的源头帖

"Primitive"这个词,像一根火柴扔进了汽油桶。

要知道,Anthropic的Fable 5是当时公认的最强前沿模型之一。说一个还没影儿的东西能让Fable"显得原始",这要么是年度最大的牛,要么是年度最大的新闻。

社区瞬间沸腾有人画信息图,有人算参数,有人喊出"四个月内三款模型!Astra→GPT-6→Doug!好到不真实!"

▲ Lumina将Doug定义为"GPT-6之外更大的预训练"

▲ 社区兴奋到失控,"忘掉GPT-6吧,Doug才是最高的天花板"

聚合大V RoundtableSpace 更是直接把话说满:Doug在NVIDIA下一代Vera Rubin芯片上训练,11月底交付,让Fable 5看起来像上个时代的遗物。

▲ 二次转述图文叠加了硬件代际、具体月份等未经核实的断言

一时间,Doug这个土到掉渣的普通英文人名,成了2026年8月AI圈最炙手可热的六个字母。

反转来了:泄露者自己打了自己的脸

但高潮还没完,反转就来了

就在帖子发出不到48小时,Chris本人连发两条澄清,口径发生了剧烈变化,

"Doug = Astra的预训练代号;Astra = 模型/模型家族的发布名。"

"另外,我一直说的年底巨型预训练,发生在Doug之后。"

▲ Chris与SemiAnalysis、Cerebras沟通后自我修正:Doug其实是Astra的底座代号

▲ 最简版澄清,"Doug = 预训练代号,Astra = 发布名"

换成通俗说法:Doug是Astra的"地基",并不存在所谓神秘的第三条赛道。 你听到的GPT-6、Astra、Doug,很可能说的是同一件事的不同切面

混淆的原因?Chris自己解释:OpenAI在5月到7月间同时跑着多轮重叠的预训练,甚至在5.6-Sol还没发布时就已经有模型跑完了。这种"流水线作业"让外部追踪者根本分不清哪个代号对应哪条线。

Lumina也随即更正,但同时又塞进了"约10万亿参数"等更刺激的未核实数字,信息纠偏和信息投喂,在社交媒体上永远是同时发生的。

▲ 更正归更正,新的未核实数字照塞不误

冷静的人在说什么?

在狂欢与翻车同时上演的48小时里,Mike Sulka的连续发帖像一盆冷水,

"Astra都还没到呢,谣言已经在讨论它后面的东西了。"

"前沿实验室永远在训下一款模型,这件事本身不该让人惊讶。"

"Doug目前只是interesting smoke(有趣的烟)。我在等fire(火)。"

▲ "有烟等火",最该关注的是SemiAnalysis"克服预训练问题"这个判断本身

他说得对Doug这个代号本身不重要,重要的是那句前缀:"OpenAI has overcome their pre-training issues"(OpenAI已克服其预训练问题)。

如果这句话为真,意味着一件事,

Scaling Law或许尚未撞墙。卡住两年半的是工程问题,而如今这个问题可能已被解决。

官方怎么说?Astra的双面剑

OpenAI官方全程没有提过Doug这个字。但他们在同一天,8月7日,发布了一篇关于Astra的安全博文,透露的信息同样震撼:

Astra在内部评估中展现出的智能体编程与网络安全能力,使得公司无法排除它触达"Critical(关键)"级网络安全门槛的可能。

▲ OpenAI官方确认Astra为"next major model",并因网络安全能力评估升级控制措施

此前的GPT-5.6-Sol被评为High级,已经很高了。而Astra直接触发了Critical级警报,意味着它可能具备在加固的真实关键系统上自主发现并利用零日漏洞的能力。

OpenAI因此加强了沙箱隔离、暂停了部分内部使用权限

这形成了一个极具张力的画面:底座在变强,但越强的模型,离用户的手可能越远。 "最大预训练"不等于"最大公开可用模型",安全流程本身就是一道闸门。

土气代号背后:一条技术路线可能复活

让我们回到最核心的问题

Doug重要吗? 作为一个代号,它一点也不重要明天OpenAI可能改叫它Eric、叫它Potato、叫它任何东西。代号泄露的历史充满改名、合并与取消,ChrisGPT自己48小时内翻车就是最好的注脚。

那什么重要?

"预训练主线的复活"这件事本身

过去两年,整个行业的关注重心从"更大的底座"转向了"更聪明的推理",o1式的长思考、RL强化的工具使用、推理时多花算力换质量。这条路走出了惊人的成果,但产业分析师一直在警告:如果底座不换代,后训练的天花板终会到来

现在,如果SemiAnalysis的判断属实,OpenAI不仅修好了预训练的工程难题,还启动了有史以来最大规模的训练,那意味着:

两条路要合流了 更大的底座 × 更成熟的后训练 × 已经验证过的推理扩展,三者结合可能呈现乘法效应

Spud(GPT-5.5)已经证明了"新底座+新后训练"组合的威力,它被管理层描述为"new base, new pre-train",产品化后口碑远超Orion的尴尬。Doug/Astra要做的,是把同样的配方推到更大的算力与数据预算上。

▲ 截至材料截止时,GPT-6仍未在任何官方目录中落地,官方API ID、价目表和发布日期均未出现

烟雾、表格、和待填的空格

此刻的事实清单异常简洁:

已确认
未确认
OpenAI官方点名Astra为下一个重大模型
Doug与GPT-6产品名的最终对应
SemiAnalysis公开表述"预训练问题已克服,Doug在推进"
具体参数量(10万亿?)
ChrisGPT修正:Doug=Astra的预训练代号
具体硬件平台与发布月份
Astra触发Critical级网络安全评估
"已开训/已完训/已进入审批"的确切时态

至于那些"10万亿参数""Vera Rubin芯片""11月底交付"的说法?它们频繁出现在信息图里,在证据链上却薄如蝉翼。

有一条评论说得精准:"除非它会跳dougie,否则不算AGI。"

▲ 面对AI圈最土的代号,网友选择以玩梗回应

玩笑归玩笑但2026年的下半场,正在变成近年来最密集的模型竞赛窗口。 Anthropic的Fable 5.5被预期在同期到来,Google在DeepMind大换血后急需证明Gemini没有掉队,而OpenAI,如果Doug/Astra兑现哪怕一半的预期,将重新拿回底座模型的领先位置。

烟雾已经升起至于火焰,整个行业都在等