夜雨聆风学习资料网

ARTICLE · 1048008

上线仅7个月!OpenAI秘密处死极速编程神作,奥特曼曾吹上天

上线仅7个月!OpenAI秘密处死极速编程神作,奥特曼曾吹上天

没有一点点防备,OpenAI 突然亲手扼杀了自己的“亲儿子”。

2026 年 9 月中旬,一行冷酷的更新日志悄然出现在官网:GPT-5.3-Codex-Spark 正式停用桌面应用、命令行 CLI、IDE 插件,全线拔线,瞬间阵亡。

▲ 官方更新日志明确标注:GPT-5.3-Codex-Spark 正式停用

无数熬夜写代码的程序员打开电脑,突然发现终端疯狂报错,自己的自动化脚本全部瘫痪。

很多人甚至还没反应过来:这个曾在半年前由山姆·奥特曼(Sam Altman)亲自站台力荐、跑出每秒 1200 个 Token 惊人极速的“编程闪电侠”,怎么说没就没了?

从 2026 年 2 月作为研究预览高调降临,到 9 月被无情扫地出门,它的生命周期仅仅维持了 214 天

在大模型狂飙突进的残酷战场上,这场突如其来的“处决”,究竟撕开了 AI 进化怎样血淋淋的真相?

狂飙诞生:每秒狂吐 1000 词,奥特曼曾为它狂喜

把时间拨回 2026 年 2 月 12 日那一天,整个开发者圈子都在为它狂欢。

山姆·奥特曼难掩兴奋,在 X(原 Twitter)上公开发帖造势:“GPT-5.3-Codex-Spark 今天作为 Pro 用户的研究预览正式上线。每秒生成超过 1000 个 Token!

▲ 奥特曼发推盛赞 Spark 模型速度突破 1000 tok/s

每秒 1000 到 1200 个 Token 是什么概念?

通常的大模型写代码,就像一位老教授在黑板上慢条斯理地推导公式,你得喝口咖啡等它打字;而 Spark 简直就是加特林机枪疯狂扫射你按下回车的一瞬间,几百行代码已经在屏幕上“轰”地一声喷涌而出。

为了追求这种极致的“零延迟体感”,OpenAI 破天荒地联手了芯片界的新贵 Cerebras

他们把模型架构大幅精简,专门针对“实时编程”进行极限调优。官方给它的定位极其诱人:你在本地改几行代码、微调一个函数、或者在终端里快速查个错,Spark 都能做到指哪打哪,几乎不给人类大脑任何等待的空隙。

在随后的几周里,负责 Codex 产品的负责人 Tibo 还在不断加码,兴奋地向社区汇报:经过底层通道优化,Spark 的生成速度再次飙升 30%,彻底突破了 1200 tok/s!

▲ 官方团队曾骄傲宣布 Spark 实际速度超越 1200 tok/s

那时候,所有人都以为看到了下一代交互式编程的未来:模型变小一点无所谓,天下武功,唯快不破。

然而,命运的齿轮早在这时就埋下了倒计时的引线。

残酷反转:没有智商的极速,只是死得更快

爽过最初的几秒钟后,全球开发者很快就撞上了一堵冰冷的高墙。

大家渐渐发现:这台性能超跑,是个不折不扣的“偏科生”。

为了把延迟压到极限,Spark 付出了极其惨痛的代价:它只有 128k 的纯文本上下文,不支持多模态识图,核心的逻辑推理能力也受到严重削弱。

在业界的权威评测中,真相暴露无遗:在 Terminal-Bench 2.0 和 SWE-Bench Pro 这类考察复杂工程能力的真实测试里,Spark 跑完一个任务的用时确实极短,但任务成功率却惨不忍睹,被完整版的 GPT-5.3 远远甩在身后。

一位资深架构师在社区留下了极其毒辣的评价:

“没有智力支撑的极速毫无意义,它只是让你更快地写出一堆垃圾代码,然后再逼你花十倍的时间去擦屁股。”

在实际开发中,现代软件工程动辄是成百上千个文件的大型代码仓库。Spark 只要读几个复杂的依赖项,上下文立马捉襟见肘;一旦涉及多步骤的架构重构,它就开始胡言乱语、答非所问。

那为什么在长达半年的时间里,大家嘴上骂它笨,背地里却依然天天用它?

答案非常实在,甚至带有一丝黑色幽默:大家看重的是它不占用主额度的“独立备用油箱”!

▲ Codex 官方账号汇总下架变更,要求用户立即迁移

在每月 200 美元的 ChatGPT Pro 高昂订阅体系下,高级模型的周额度极其金贵。许多人往往在周中就把主额度打光了,而 Spark 恰好拥有完全独立的配额

大家把它当成了“备胎”:主油箱空了,拿 Spark 顶上,写写无脑的小脚本、打打格式化杂活。

它能在产品目录里苟延残喘七个月,很大程度上是靠这层“配额红利”吊着一口气。

降维打击:当全能学霸学会了瞬移,小丑就该退场了

给 Spark 敲响丧钟的,正是 OpenAI 内部技术路线的残暴迭代。

2026 年 8 月 13 日,OpenAI 正式发布重磅更新:GPT-5.6 Sol 极速模式(Ultrafast mode)上线预览!

▲ Cerebras 联合 OpenAI 宣布 GPT-5.6 Sol 极速模式上线,速度暴增最高 14 倍

这一招,直接打碎了 Spark 存在的全部逻辑。

以前,整个 AI 行业的潜规则是:要高智商就得忍受慢,要极速就必须阉割智力Spark 就是这种妥协下的产物

但 Ultrafast 模式彻底颠覆了规则,OpenAI 放弃了打造缩水小模型的折中路线,直接把满血旗舰 GPT-5.6 Sol 架在超强硬件集群上狂飙,硬生生跑出了 750 tok/s 的超高输出速度!

这是赤裸裸的降维打击:

  • 智力水平:保持旗舰大模型的顶尖推理,不再降智;
  • 运行速度:比标准模式暴增最高 14 倍,直逼人类感官极限。

速度从独立的“特供模型”,演进为顶级大模型自带的“加速挡位”。

当那个无所不能的全能学霸突然学会了“瞬间移动”,谁还会去挽留一个只会狂奔却连题都做不对的偏科神童?

正如产品负责人 Tibo 在退役推文中所坦白的那样:Spark 走过了一段不错的旅程,但它的使用量已经持续下滑,既然我们手里已经有了明显更强大的模型,“是时候给未来腾出空间了”。

▲ 社区用户确认 Spark 已从选择器中移除,算力正在向新一代架构转移

绝情清洗:幽灵额度、段子狂欢与大模型大淘汰时代

9 月 14 日,OpenAI 终于按下了清理按钮。

但在这一波退役交接中,现场一度出现了极其魔幻的“UI 幽灵”现象。

大量开发者发帖吐槽:打开账号后台,明明还能看到 Spark 那一周 5 小时的独立额度条,但只要在命令行或 IDE 里敲下命令,系统立刻无情报错:The 'gpt-5.3-codex-spark' model is not supported when using Codex with a ChatGPT account.

▲ 用户发截图质问:为什么模型停用了,用量页还在显示它的额度?

额度明明在,调用却被拒程序员们在社区里办起了讽刺性的“赛博追悼会”,还有不少高赞回复在疯狂刷屏“RESET”梗,大家焦急地追问:Spark 被砍掉的算力,能不能折算成新模型 GPT-5.6 Luna 的额度补给我们?

大清洗的范围甚至更为广泛

仔细阅读 9 月 14 日那份更新日志,你会发现更震撼的并列条款:曾经不可一世的 GPT-5.5,也将在 10 月 14 日被彻底赶出 ChatGPT、ChatGPT Work 和 Codex!

▲ 更新日志并列披露:GPT-5.5 将在 10 月 14 日彻底退役

OpenAI 正在以极其激进的姿态清理历史包袱:

  • 旧时代落幕
    :带有繁琐绰号与冗长命名(比如 GPT-5.3-Codex-Spark)的过渡产物被成批抹去;
  • 新星系建立
    :以 Sol(太阳)、Terra(大地)、Luna(月亮)、Astra(星辰) 命名的 GPT-5.6 家族正式完成接管。

避坑指南:手把手教你完成清理

如果你也是每天依靠 AI 辅助开发的重度用户,这场退役绝不仅仅是一条科技八卦,而是会真真切切砸碎你工作流的生产事故。

请立刻按照以下步骤排查你的工具链:

  1. 地毯式搜索本地代码
    :立刻在你的全局配置、项目配置文件、自动化定时任务中,全局搜索 gpt-5.3-codex-spark 这一串字符串,并将其替换为官方推荐的当前模型(如 gpt-5.6-sol)。
  2. 重置 IDE 与 CLI 缓存
    :检查你的 VS Code 插件、Cursor、Codex CLI 默认模型选项,如果仍停留在 Spark,手动切换到推荐型号,避免请求被网关直接拒收。
  3. 不要迷信界面残留的额度
    :用量统计页面上的残留分项只是 UI 延迟同步,切勿将其当作“还能跑”的依据。
  4. 转变对“速度”的认知
    :如果未来你需要极速响应,请在旗舰大模型中寻找 Fast mode 或 Ultrafast mode 档位,而不要再等待一个同名的小模型回归。

极速时代的冷酷启示

从 2 月 12 日的“举世皆惊”,到 9 月 14 日的“冷血下架”,GPT-5.3-Codex-Spark 用短短 214 天,走完了一个 AI 产品的完整一生。

它像一颗耀眼的流星划过夜空,证明了超低延迟在编程领域的惊艳体感,但也用自己的消亡印证了一条颠扑不破的技术铁律:

在智能革命的深水区,纯粹的低延迟只是敲门砖,深不可测的逻辑推理能力才是立足之本。

大模型的残酷进化永不停歇旧王甚至还没来得及老去,就已经被新王踩在脚下,化作了一行行被注销的代码。

相关学习资料