

一个朴素得近乎无聊的英文名,正在让整个AI圈的神经末梢集体过电。
它不叫GPT-6,也不叫Astra,更不像任何科幻飞船的代号。 就叫 Doug
2026年8月的第一周,一份产业研究机构报告里夹带的简短消息,像石子投入平静湖面,给硅谷盛行的“预训练已死”论调撬开了一道裂缝。社交网络上开始流传一个让所有人后脊发凉的说法:OpenAI已经把预训练的堵点打通了,正在秘密推进一场“迄今最大规模”的基座模型训练,而它的名字,就是那个不起眼的Doug。
还有传闻称,更庞大的项目还在Doug后面。
一则要命的消息,藏在Gemini的讣告里
事情的起点,充满了黑色幽默
产业研究机构 SemiAnalysis 在8月7日发了一篇长文,标题主旨本来是给 Google DeepMind 和 GCP 做体检的,名为《Gemini is Cooked but GCP is Cooking》。文章里讲的是DeepMind人事地震、资深研究员出走、算力被云业务挤压,整篇文章都在分析Google AI为何“凉了半截”。
后来被中文英文社交媒体紧盯的,却是夹在机构客户笔记摘录里的一则简短消息:
OpenAI has overcome their pre-training issues, and a much larger model code named “Doug” is actively in the works.
翻译过来只有一行:OpenAI已经克服了预训练的问题,一个更大、代号“Doug”的模型正在积极推进中。

▲ SemiAnalysis 报道中夹带 Doug 原句的段落,本来主角是 Gemini 的坏消息
这简直是小说里才能写出来的反差 一篇“谷歌垂危”的报道,顺手给OpenAI敲了一声战鼓。文章作者署名里有 Dylan Patel、Doug O'Laughlin 等人,Doug O'Laughlin 和代号 Doug 同名,纯属巧合,却成了后来的一大误读来源。
转折来自一位长期跟踪OpenAI模型动向的X用户 Chris(@ChrisGPT)。
8月8日晚,Chris发了条帖子,火力全开:
GPT-5.5不会是最后一次重大预训练; 他此前暗示过的“年底模型”,将是 OpenAI 迄今最大的一次预训练; - 这个代号 Doug 的东西,将让 Anthropic 的 Fable 系列显得“原始”(primitive)。
紧接着,@DanDr1s、@WesRoth、@rohanpaul_ai、@haider1 等账号相继转发,文案一个比一个狠:“史上最大、在GPT-6之后”“基座+后训练双引擎叠加”“事情会变得非常有意思”。
一场围绕“Doug”的社交海啸,就这样毫无预兆地拍了下来。

▲ Chris 的原帖,引出 Doug 热潮
两天后,爆料人自己“改口”了
这个故事最精彩的地方来了,它像一场精心编排的悬疑剧,第一幕就埋了反转。
8月9日,Chris 发了一条更正帖。在跟 SemiAnalysis 和 Cerebras 的人聊过之后,他的“当前理解”变成了一个新的版本:
Doug 是 Astra 预训练 run 的代号,Astra 才是模型/模型家族名。而自己此前一直说的“年底巨无霸预训练”,其实发生在 Doug 之后。

▲ Chris 的更正帖,一石激起千层浪:Doug 和 Astra 到底是什么关系?
好家伙这一更正,让整个社区彻底精神分裂公开说法自此分裂成两套:
说法A: Doug是独立于GPT-6的、更晚更大的预训练,这是流行最广的版本,也是多数二次媒体采信的脚本。
说法B: Doug只是Astra这场训练run的内部代号,更大的项目还在后面。
两条说法互相打架,却都指向同一个方向:OpenAI的基座预训练机器,真的重新开动了。 只不过尺寸和节奏比所有人想象的还要狂野。
Chris还给了一个让人头皮发麻的解释,OpenAI在5到7月之间并行跑了多条重叠预训练,甚至在5.6发布之前,就有一个模型已经ready了。
这原本就是“默认状态”吗?
就在全网嗨到最高点的时候,一盆冷水从投资人Mike Sulka(@SulkaMike)那里泼了下来,冷静得刺骨。
他的核心质疑只有一条:
OpenAI、Anthropic、Google DeepMind、xAI,哪家不在持续训练下一个模型?
“下一代模型正在训练”不应该是新闻,更罕见的情况是“训练完了却停下来”。 大家现在对着Doug、Mu、Astra这些代号做考古学,把正常的研发节奏硬生生读成产品路线图,是在重复一个AI圈最老套的集体幻觉。

▲ Sulka 的反驳一针见血:有烟,但还没见着火
这段话很适合停下来想三秒 坦白说,他说的没错市场兴奋的焦点落在了“预训练这门生意重新变得性感了”这件事上。
要理解这件事,得把时钟往回拨两年
那场“预训练已死”的集体幻觉
2024年5月,GPT-4o发布,多模态和低延迟惊艳世界。但自那以后,OpenAI很长时间没有完成一次“可作为新一代旗舰部署”的全规模预训练。能力跃迁,更多来自o1、o3、GPT-5系列上的后训练、强化学习与推理时计算。
GPT-4.5(内部代号Orion)成了那个尴尬的注脚:贵到离谱,智能提升却让挑剔的用户打哈欠。 随后GPT-5走得更大胆,Epoch AI的分析指出,其最终训练的算力很可能低于GPT-4.5。这是一种务实选择:后训练技术在边际上比单纯堆预训练更划算。
于是“scaling is dead”“pretraining stuck”的标题开始流行。整个产业把“更大的基座”从信仰降级成了可选项。

▲ Epoch 的经典分析:GPT-5 算力反而缩水,但 GPT-6 大概率要重新加码
但Epoch那篇文章的副标题其实藏着一个预言:GPT-6 probably won't(use less)。 后训练扩展的边际收益终有吃尽的时候,届时基座缩放必须回归。
Doug的出现,刚好坐在这条预期的延长线上。
“Garlic验证 → Doug放大”的连环画
BigGo和AIbase的梳理,勾勒出了一条几乎可以拍纪录片的完整故事链:
2025年11月,Gemini 3带来巨大竞争压力;12月,The Information曝出OpenAI有个代号 Garlic 的新预训练模型,在编程和推理上表现出色,首席研究官Mark Chen内部表示预训练的某些早期问题已经被解决。随后,Garlic被定位成“修复方法的验证机”,而Doug,则是“把验证过的方法推到更大尺度的执行体”。
先跑通,再放大这是工程上最古老的逻辑,也是最恐怖的一招。
而且别忘了物理前提SemiAnalysis早在2024年9月就讨论过OpenAI/Microsoft的多数据中心训练计划:单站点十万卡已经逼近电力和同步极限,想要再大一个数量级,必须在多园区、多站点间协同调度。这场“史上最大预训练”背后是一整套存储、网络、调度和容错的工程巨兽。 现在有人说这头巨兽已经热身完毕,你怎么可能不兴奋?
名字越土,事情越大
说点轻松的 “Doug”这个代号本身就构成了一场命名实验。
在Orion、Garlic、Spud、Astra这些或神秘或科幻的代号里,Doug就像一个穿着格子衬衫的中年大叔闯进了太空军基地。 反差感本身就是流量网友开始玩梗,“Do the Dougie”舞曲的谐音被翻出来,甚至连SemiAnalysis作者Doug O'Laughlin的同名巧合都成了段子素材。
但硬币的另一面是社区命名文化里的深层焦虑:这些铺天盖地的代号,到底有几分是真的?

▲ 被广泛转载的“种子帖”,把 Orion、Spud、Sol、Doug 串联成完整故事线,但可信度参差不齐
入口“种子帖”@vidhisharmx 号称“OpenAI已启动史上最大预训练、远超GPT-6、代号Doug”,阅读量高得惊人。但细看会发现,这只是一篇二手综合叙述,把 SemiAnalysis、ChrisGPT 和社区传闻炒成一盘菜,参数、芯片、时间线无一经过核验。@RoundtableSpace 甚至加码出“Vera Rubin 训练、11月底”的强断言,已经属于典型的“高关注、低核验”层级。
这才是AI爆料产业链最危险的地方:一条夹带在别人家报告里的话,经过四层转发,就能变成“OpenAI内部已启动核弹级项目”的铁证。
该盯住“预训练堵点被打通”
把情绪抽干之后,这件事里最有价值的信息是:
业界认为 OpenAI 的预训练阻塞有所缓解,并且敢于公开讨论更大规模的基座 run。
这才是实际增量至于“Doug将使Fable显得原始”,这属于社区修辞,只反映了把Anthropic当标尺的习惯,缺少基准测试支持。 INSIDE的报道里还提到Anthropic或有Fable 5.1对位,同样是未证实的市场耳语。
站在2026年8月这个节点,你可以清晰地看到一条摆锤轨迹:
2019–2023,基座是神;2024–2025,后训练夺权;2026,基座带着Doug的名字杀回来了。
而且这次可能出现双线并进AGI竞赛的下一幕,可能是基座与后训练的双核叠加,Wes Roth那篇帖子强调的也正是这一点:如果OpenAI把预训练重新拉起,再把已经练到炉火纯青的RL和推理时扩展叠罗汉一样压上去,曲线的斜率可能从过去两年的“温和爬坡”骤然变成“直角拐弯”。

▲ Wes Roth的解释框架:基座+后训练双引擎,是这轮Doug热背后的核心逻辑
当然,截至发稿,OpenAI对Doug只字未提。Chris的更正已经证明,连最早的信源自己都在修正坐标。Doug与Astra的关系、参数规模、芯片型号、发布窗口,全都不存在可审计的证据。
“有烟,等火” Sulka说得冷静而精准
但你要承认,这缕烟的味道,已经让市场开始缺氧了。

夜雨聆风