乐于分享
好东西不私藏

OpenAI最大预训练代号曝光!一个叫“Doug”的怪物正在炉中,Anthropic旗舰或沦为“原始人”

OpenAI最大预训练代号曝光!一个叫“Doug”的怪物正在炉中,Anthropic旗舰或沦为“原始人”

八月的硅谷,空气中弥漫着一种不寻常的焦灼。

加州山火与这份焦灼无关源头是一个极其普通的英文名字:Doug。它飞快撕扯着整个AI社区的神经发布会、官方博客和山姆·奥特曼的推文统统缺席;藏在付费研报里的旁注、几条高互动帖文,再加上一轮令人头晕的自我更正,却在48小时内拼出了一张让所有人屏息的路线图:OpenAI可能正在推进其历史上规模最大的一次基础模型预训练。

如果消息属实,这将是一场底座级的地壳运动,远超常规迭代的幅度。

旁注掀起风浪

故事的引线,埋在产业研究机构SemiAnalysis于8月7日发表的长文《Gemini is Cooked but GCP is Cooking》里。这篇文章的主角其实是Google,讨论DeepMind领导层震荡与Google Cloud的算力分配。但在文章深处,一段引用自7月9日机构备忘录的摘录中,夹着这样一行:

OpenAI has overcome their pre-training issues, and a much larger model code named "Doug" is actively in the works.

▲ SemiAnalysis公开长文中引用的7月9日机构备忘录,Doug一词首次出现在正规产业研究出版物中

原文只给出这一行,参数量、训练集群细节和完成日期一概未提。它却把两件事焊死在一起:预训练问题“已克服”,更大规模模型“正在推进”。

为什么这句话能炸?因为它戳中了过去两年AI圈一个公开的秘密

“预训练恐惧症”:OpenAI的阿喀琉斯之踵

这里要给非技术读者补一个关键背景。

预训练,你可以理解为给AI“读遍天下书”的过程,用海量数据做大规模训练,先造出一个什么都见过但还不太听话的底座模型它极贵、极慢、极吃算力,但决定了模型知识广度和后续潜力的天花板

后训练则是在底座上精雕细琢,用人类反馈、强化学习、推理链训练等手段,把模型调成好用、安全、会思考的产品。过去两年,OpenAI在这条路上高歌猛进:o系列推理模型让“多想一会儿再回答”成为行业共识,推理时计算的红利被吃得淋漓尽致。

但底座呢?自2024年5月GPT-4o之后,社区里反复流传一种说法:OpenAI的后训练是把好刀,但刀柄,也就是预训练底座,迟迟没换新的。代号Orion的预训练曾被寄予厚望,结果据传“极大、极贵、智力提升却不匹配”,成了行业内教科书级的反面案例。

所以当SemiAnalysis写下“预训练问题已克服”时,这个判断还指向更大的变化:OpenAI重新把底座引擎拧紧了

48小时:从一句旁注到“全球路线图”

SemiAnalysis的那行文字像一枚石子投入湖面。随后出现的层层转述,展示了AI信息时代的扩散链条。

8月8日,X平台上的知名AI信息账号@ChrisGPT发出了一条让整个社区炸锅的帖文:GPT-6会很强,但还有一个更大的预训练项目在后面;代号Doug;它将强大到让Anthropic刚发布的旗舰模型Fable显得“primitive(原始)”。

▲ ChrisGPT的帖文迅速成为社区引用的核心节点,“使Fable显得原始”的说法激起热议

这条帖子的影响如同一枚核弹“Primitive”这个词,在竞争话语中是一把淬了毒的匕首,直指代差,远比“稍逊一筹”尖锐。

紧接着,@iruletheworldmo贡献了更惊人的细节拼图:OpenAI意识到预训练落后后,砍掉了Sora等项目,腾出资源同时推进三条预训练线,规模分别为5万亿、10万亿、15万亿token,内部代号分别叫Spud、Doug、Dougtrio

▲ "你编不出这种东西",三条预训练线的代号分别是Spud(土豆)、Doug和Dougtrio

是的,你没看错Spud是土豆,Dougtrio让人想起宝可梦里的三地鼠。 有人在评论区崩溃地问:“为什么不叫Phoenix?为什么必须是Doug?”还有人直接放话:“不会跳Dougie就不算AGI。”

▲ 社区对代号的灵魂拷问:为什么不叫Phoenix,偏偏要叫Doug?

但就在狂欢还没降温的时候,剧情反转了

自我更正:Doug到底是谁?

8月10日,最初点燃导火索的@ChrisGPT发出了一条至关重要的更正帖

与SemiAnalysis和Cerebras的人交流后,我目前的理解是:Doug是Astra预训练的代号,而Astra是模型/模型家族名。此前我和很多人把两者混用了。

▲ 关键更正:Doug可能只是Astra预训练阶段的工程代号,而非独立的“年底怪兽”

下半句又添了一层悬念:其此前所说的“年底怪兽级预训练”,发生在Doug之后。 Doug的定位可能仍非终点,后面还有

同时,这条更正还透露了一个工业级的细节:2026年5至7月,OpenAI内部存在多轮重叠预训练,甚至在GPT-5.6上线之前,下一代模型就已经就绪。

这些说法共同拼出一幅更宏大的画面:前沿实验室的模型生产线,早已铺开多条管线,像流水车间般并行推进。 当你还在研究最新发布的时候,下一个、下下一个底座已经在某个集群上默默地跑了几个月。

而Astra,已经在这里了

在Doug的传闻满天飞的同时,一个有官方盖章的名字安静地站在聚光灯下。

8月1日,OpenAI发布研究帖文,宣布其“下一代重大模型的内部版本”,Astra攻克了十个长期未解的数学与理论计算机科学难题,并附上了Lean形式化证明。按官方估算,寻找这些解的token成本约2000美元

8月7日,更重磅的官方声明来了OpenAI称,对Astra的内部评估显示,该模型在智能体编程与网络安全方面达到了前所未有的水平,按其《准备框架》,被列为公司首个“Critical(关键)”级别的网络安全模型。

▲ OpenAI官方措辞谨慎但信号明确:Astra被视为首个需要“关键级”网络安全管控的模型

这两步的发布策略颇有意味OpenAI跳过定价和上架日期,先用数学证明和安全评级介绍下一代旗舰。这像是一个拳手在正式上擂台之前,先在训练馆里对着沙袋打出了一组让所有人噤声的组合拳。产品尚未露面,锋芒已经显现

三个名字,一团迷雾

到这里,公共讨论同时存在至少三种不完全兼容的说法

  1. Doug = 年底更大预训练
    ,晚于且大于Astra / GPT-6;
  2. Doug = Astra预训练的工程代号
    ,产品名另定;
  3. Doug之后还有更大的
    ,可能叫Dougtrio或其他什么。

而评论区里,另一场争论同时展开:Astra与GPT-6是否指向同一模型? 一些用户激烈纠正标签混用,要求停止转述错误信息。

事实上,此前被广泛预期为GPT-6的代号Spud,最终以GPT-5.5的身份落地,这已经是“编号进步主义”被现实打脸的前车之鉴。实验室内部的工程名、安全评审名、市场名完全可以三者分离:Doug可能永远不会出现在任何用户界面上,就像你不会在ChatGPT的下拉菜单里看到“土豆”。

名字之外的关键问题

退一步看,这场48小时的信息风暴留下三个关键问题,“Doug是谁”只占很小一部分。

第一,预训练是否真的修好了 如果SemiAnalysis的判断成立,意味着OpenAI不再只靠后训练和推理扩展的边际收益续命,而是重新拿到了底座放大这张牌。在Anthropic的Fable和Google的Gemini都在疯狂迭代的当下,这是一个改变竞争格局天平的变量。

第二,“Critical”级安全评级意味着什么。 Astra已经被标到了网络安全的最高预警区间。如果Doug真的是一个更大的底座,那它在安全审查上面临的阻力只会更大。未来的发布瓶颈,可能从“训练不出来”变成“训出来了但不敢放出去”

第三,信息级联的速度已经快到危险 一句机构备忘录的旁注,经过关键节点账号加料、二手媒体转述、再到整理帖图解,每一跳都丢失限定词,“as far as I know”不见了,“actively in the works”变成了“已启动”,“codename for pretraining”变成了“独立的年底怪兽”。

正如一位冷静的评论者所写:前沿实验室永远在训练下一个模型,这本应是默认假设。信息量集中在“更大”和“问题已解决”是否属实,新冒出的名字反倒居于其次。

▲ 并非所有人都在狂欢,有人提醒:连Astra都还没用上,就开始讨论Doug是否为时过早

烟雾里永远有一个更大的名字

让我们把镜头拉远

2026年的AI竞赛已经进入一种新常态:你永远同时面对两条时间轴,一条是“下个月能用的”,一条是“烟雾里更大的”。Astra属于前者,Doug(无论它最终叫什么)属于后者。而后者的存在,本身就是一种战略武器:它管理期待,它震慑对手,它让投资人保持兴奋。

OpenAI用数学证明和安全框架亮出了Astra。社区用备忘录旁注和匿名断言拼出了Doug。一个有官方盖章,一个还在烟雾中 但两者合流之后,传递出的信号只有一个,

底座引擎重新点火了而这一次,他们似乎不打算只点一次