八月的硅谷,空气里弥漫着一种比加州山火更灼人的气息,恐惧与贪婪交织的味道。
一个词,四个字母,Doug,像一颗信号弹射入AI社区的夜空。48小时之内,它从一条推文变成全球科技媒体的头条关键词,又在作者本人的更正中被重新定义。但旧说法的截图早已流传开来,这就是2026年AI信息战的速度:谣言跑完半个地球的时候,澄清还在穿鞋。
故事的开端,简单到令人不安
一条推文,炸开一个代号
2026年8月8日,X平台上的知名AI追踪者Chris(@ChrisGPT)发了一条帖。他的账号简介写着,内容曾被The Information、纽约时报和TechCrunch提及。这次他写得很干脆,像在宣读战报:
GPT-5.5之后,OpenAI还会进行重大预训练。GPT-6会很强但他六月就暗示过的“年末模型”,将是OpenAI迄今最大规模的预训练。代号:Doug它会让Fable显得原始

▲ Chris种子帖,四段话叠出一个惊人的结论
“Fable”,Anthropic旗下的前沿模型代号,在社区语境里就是当前最强之一的代名词。说一个东西能“让Fable显得原始”,约等于说:这玩意儿要掀桌子了。
帖子未交代参数量、训练地点和发布时间表,也未引用OpenAI官方声明。它把四个判断像叠罗汉一样摞在一起,然后点燃了引信。
转述帖瞬间涌来@DanDr1s几乎逐条复述了Chris的结构,阅读量同样惊人。@Ananth7e更是激动地排列出一条让人窒息的时间线:Astra、GPT-6、Doug,三个模型,一个比一个猛,四个月内连发。 他补了一句:“如果这是真的,简直好到不敢相信。”

▲ 社区迅速构建出“三连跳”说法,兴奋值拉满
好到不敢相信? 事实证明,确实不该全信
24小时反转:Doug究竟是什么
就在全网还在为“年末超级模型Doug”欢呼的时候,始作俑者自己开始踩刹车了。
8月9日,Chris发布了一条引用自己原帖的澄清推文。他说,在与SemiAnalysis和Cerebras相关人士交流后,他现在的理解是:
Doug是Astra预训练的代号。Astra才是模型或模型家族的名称。
此前包括他自己在内,很多人把Astra既当代号又当产品名,搅成了一锅粥。此外,他一直说的那个年末“怪兽级”预训练,发生在Doug之后,属于另一项计划。

▲ 不到24小时,作者亲手改写了自己最先抛出的说法
公众最先读到的故事是“年末有个叫Doug的超级模型要碾压一切”;作者本人很快把剧本改成了“Doug应当是Astra底座的训练代号,年末还有更大一轮”。
这个反转的技术背景是:OpenAI在五到七月并行推进了多轮预训练,甚至在GPT-5.6发布前就已经有模型就绪。外部观察者面对的是一张故意不完整的地图,Spud、Garlic、Doug、Mewthree、MewFour、Astra……当这些内部代号像弹幕一样飞过来的时候,任何人都可能把“一次训练运行的绰号”误认成“年底上架的App名称”。

▲ TokenGremlin拆解:多轮重叠预训练构成了复杂的产品图景
10万亿参数:规模崇拜还是真实飞跃?
混乱之中,一组数字最为抓眼球
@Adidotdev甩出了一张信息图,社区最爱的对比句式赫然在列:Sol建在代号Spud、约5万亿参数的预训练之上;Astra跑在代号Doug、约10万亿参数的预训练之上,直接翻倍。并且声称OpenAI研究人员对Astra的兴奋度远高于Sol,“写作质量与情商接近顶尖人类写手”。
帖文自带一行良心标注:still unverified。

▲ 5T→10T的跃迁说法尚未证实,却已成为社区广泛引用的数据框架
但冷静派的声音同样响亮评论区里有人直接开怼:参数量几乎不重要,数据配比和后训练才是关键。现代大模型普遍采用稀疏激活或混合专家架构,总参数可以很大,但每个token只激活一部分。所以“两倍参数”≠“两倍聪明”,更不等于“两倍好用”。
这其实触及了一个更深层的行业辩论:过去两年,AI能力的飞跃到底来自哪里?
预训练回归:一场静悄悄的路线之争
要理解Doug为什么能激起全网情绪,可以倒带看一段被很多人忽略的历史。
自2024年GPT-4o发布以来,OpenAI对外展示的能力跃迁,越来越多地被解读为后训练、强化学习和推理时算力的功劳。o1、o3、GPT-5统一路由架构……这些名字背后,讲的是同一个故事:底座没怎么换,但“精加工”越来越猛。就像一块玉,料子没变,但雕工一代比一代精。
问题来了:如果底座长期不换代,只靠后训练往上堆,边际收益迟早会变薄。
SemiAnalysis等机构反复讨论过这个隐忧。而当竞争对手在2025年末拿出更强的基础模型体验时,压力直接传导到了OpenAI的产品侧。据公开报道,OpenAI内部曾强调要修复预训练相关的问题;The Information在2025年12月前后报道了代号Garlic的新预训练工作,先小规模验证修复有效,再把同一配方放到更大的集群上全量推开。
Garlic是试验田,Doug则把修复后的方法搬上了更大的舞台。

▲ SemiAnalysis原文中的关键一句:OpenAI已克服预训练问题,代号Doug的更大模型正在推进
Doug故事之所以刺激,就在于它象征着预训练这条扩展轴重新加码。在RL和推理时算力已经讲了两年故事之后,底座本身要再跳一档,仿佛换上了一块更大的料子。
2026年4月,OpenAI总裁Greg Brockman在播客中首次公开谈及Spud,称其为“new base, new pre-train”,并说有大约两年的研究正汇入该模型。随后GPT-5.6家族(Sol / Terra / Luna)在六七月落地,社区形成了一条清晰的粗线:Spud底座支撑了5.5/5.6这一代;下一代更大底座需要新名字,于是Doug与Astra登场。

▲ GPT-5.6已是落地产品,Doug/Astra仍属于未官宣的“下一章”
全网最快的自我纠偏,和最慢的截图消亡
这次事件暴露了信息生态的运转速度。
Lumina账号在不到一天内,从“Doug是十一月更大模型”改口为“Doug是Astra的pretrain”。Chris引用原帖公开更正,同时保留了原帖。TokenGremlin强调自己在公开澄清前就反对“Doug是独立产品”的说法。

▲ Lumina的更正帖:引用自己前一天的旧帖,实时修正说法
消息迅速放大,随后又被澄清压缩,这个节奏就是2026年前沿模型信息环境的缩影。泄漏驱动预期,澄清修正地图,但旧说法的截图和二次创作会继续流传。8月10日,WinCentral还在按初版说法写稿;中文科技媒体的标题党更是把“最大预训练”“碾压一切”写得斩钉截铁。
而在评论区,一条回复精准地捕捉了这场狂欢的荒诞感:“除非它会跳dougie,否则不算AGI。”配了一张舞蹈动图

▲ 当严肃的预训练代号遇上流行文化的双关暴击
写在最后:代号终将消散,军备竞赛永不停歇
让我们把视线拉回到唯一确定的事实上:
OpenAI已经发布了GPT-5.6家族;已在公开材料中使用Astra指称下一主要模型的内部版本;The Information的报道将Astra与多智能体长程任务关联。而Doug,截至目前,它从未出现在OpenAI的任何产品目录、定价页面或API文档中。它仍只是一个格外吸引眼球的代号
但代号的力量恰恰在于:它让你看见一个轮廓,却填不满细节,于是想象力自己完成了剩下的工作。
10万亿参数是真是假?碾压Fable的基准在哪?年末到底发什么?这些问题现在都没有答案唯一可以确认的趋势是:在强化学习和推理时算力被反复开采了两年之后,预训练这条最古老、最暴力的扩展轴线,正在重新成为军备竞赛的主战场。
当行业觉得“后训练红利”快要见顶的时候,就会重新渴望一次干净的底座跃迁。Garlic/Doug故事之所以一点就燃,是因为它承诺了一件人人想听的事:红利还在,靠更大的机器便能兑现。
至于这个承诺是否兑现,等可独立验证的模型和基准吧。代号与传闻都不能替代正式产品和发布会。 但话说回来,在这个时代,人们总是一边怀疑,一边刷新。
夜雨聆风