乐于分享
好东西不私藏

硅谷突然掀桌!OpenAI旗舰降价33%,Anthropic被逼上绝路:8000兆瓦算力怪兽砸穿大模型底价

硅谷突然掀桌!OpenAI旗舰降价33%,Anthropic被逼上绝路:8000兆瓦算力怪兽砸穿大模型底价

大模型世界的天,又变了

OpenAI 省去了预热和冗长的发布会,直接在社交平台宣布:即日起,旗下最强旗舰模型 GPT-5.6 Sol 的 API 与积分价格,全面下调超过 20%!

▲ OpenAI 官方发布视频公告:GPT-5.6 Sol API 价格直降超过 20%

消息一出,整个硅谷开发者圈子瞬间炸锅。

要看懂这场地震,不能只看公关通稿上的“超过 20%”。最新价格表显示,变动幅度最大的项目是输出,输出 Token 价格直接从每百万 30 美元砍到了 20 美元,单项暴跌 33.3%!

OpenAI 核心员工 Sherwin Wu 随后在社交平台上发文调侃:“GPT-5.6 Sol 现在是 4 美元输入 / 20 美元输出,成了市面上最便宜的前沿旗舰顺手查了查 2023 年初代 GPT-4 的标价,当时只有可怜的 8k 上下文,价格居然高达 30 / 60 美元!我们居然已经走了这么远。”

▲ OpenAI 员工 Sherwin Wu 晒出与 2023 年 GPT-4 价格的惊人对比

三年时间,模型智商翻了几番,价格却被生生打掉了一大半。

但这次降价绝非简单的“大发善心”或例行打折。如果你把时间线拉开,把 OpenAI 四天前刚宣布的 8000 兆瓦(8 GW-IT)超级算力协议、以及老对手 Anthropic 惨淡的企业端数据拼在一起,就会看到一张令人战栗的战局图景:

这场限时促销带有强烈的竞争意味,工业级算力底座也被摆上了牌桌。

降价账本拆解:为什么砍掉“输出价格”是在下死手?

很多非技术背景的朋友可能会好奇:经常听到的“Token”到底是个啥?降价 20% 和 33% 又有什么区别?

我们可以把大模型的 API 消费,想象成去打跨国长途:

  • 输入(Input)
    :相当于你对着电话说话,你发给模型的提示词、参考资料、背景文档都算在这里。
  • 缓存输入(Cached Input)
    :相当于电话录音,如果是重复发给模型的固定资料,模型读取时收极低的地板价。
  • 输出(Output)
    :相当于大模型在电话那头给你回话。

在当下大火的 AI Agent(智能体)、自动写代码、深度推理 场景下,模型往往需要“思考很久”、输出数千行长文本或者连续调用工具。昂贵的“输出”往往更影响企业月末账单。

▲ OpenAI 开发者文档更新:GPT-5.6 Sol 促销价已正式上线

根据 OpenAI 开发者文档与社区公布的权威数据,这次价格变动极为精准:

  • 输入价格
    :从 $5.00 / 1M tokens 降至 $4.00,降幅 20%
  • 缓存输入
    :从 $0.50 / 1M tokens 降至 $0.40,降幅 20%
  • 输出价格
    :从 $30.00 / 1M tokens 狂降至 $20.00,降幅高达 33.3%

虽然 OpenAI 官方综合口径称其为“降价超过 20%”,但对于重度依赖长文本生成和复杂推理的开发者来说,核心成本几乎直接打了个六七折。

这次促销至少持续到 2026 年 11 月 21 日它直接覆盖 API 开发者与 Codex 积分方案,而 ChatGPT Plus、Pro 等个人订阅用户的额度则保持原样

OpenAI 的刀口,极其明确地对准了企业级和工程级用户。

逼近墙角:Anthropic 的“劳斯莱斯困境”

OpenAI 这一刀,最难受的莫过于死敌 Anthropic

我们直接把两家当下最顶级的公开价目表拍在桌上比一比:

  • Claude Fable 5
    (Anthropic 顶级旗舰):输入 $10 / 输出 $50
  • Claude Opus 5
    (Anthropic 次旗舰):输入 $5 / 输出 $25
  • GPT-5.6 Sol
    (OpenAI 本次降价旗舰):输入 $4 / 输出 $20

▲ Anthropic 定价页面:旗舰 Fable 5 标价高达 $10 / $50

算一笔极其残酷的算术账:现在用 OpenAI 最顶级的 Sol,价格只有 Anthropic Fable 5 的 40%! 按这一比例,跑 Anthropic 最强模型的钱,在 OpenAI 这里能跑两套半。即便是面对 Anthropic 的次级主力 Opus 5,Sol 居然还要再便宜 20%。

为什么 OpenAI 敢在这个节点痛下杀手?因为 Anthropic 的软肋,早就被华尔街看穿了。

就在降价前十天,美国知名企业支出分析机构 Ramp 刚发布了一份轰动业内的《8月 AI 指数报告》。

▲ Ramp 报告揭示企业支出结构:最强模型遭遇企业预算天花板

报告撕开了一个血淋淋的市场真相:

Anthropic 虽然在技术社区被捧上神坛,其最强旗舰 Fable 5 跑分极其惊艳,但在企业真实支出中,Fable 5 上线首月仅仅吃到了 Anthropic 体系内 6% 的 Token 用量和 11.4% 的支出份额

相比之下,OpenAI 的 GPT-5.6 Sol 一个人就扛起了自家 25% 的 Token 用量和 23% 的大盘收入

Ramp 的经济学家认为,企业对前沿 AI 的支付意愿正在撞上一堵无形的“预算之墙”。 当模型智商从 95 分提升到 98 分,但价格要翻三五倍时,企业 CFO 会毫不犹豫地按下暂停键。

Anthropic 打造了一台性能无敌的劳斯莱斯,却发现大部分企业只愿意为丰田和特斯拉买单。而 OpenAI 此时把自家原本就卖得很好的“保时捷”(Sol),直接降到了“丰田”的价格区间。

如此幅度足以把对手的旗舰产品困在高价孤岛上。

幕后重器:8000 兆瓦的“电力阳谋”

大模型降价常被归因为烧钱补贴,但 OpenAI 手中还有另一张牌。

就在宣布降价的仅仅 4 天前(2026年8月17日),OpenAI 官方悄悄挂出了一篇极具分量的产业公告:《OpenAI 加入 PORTS-Pike 项目》。

这篇公告里藏着令人倒吸凉气的硬核数据:

  • OpenAI 与 SB Energy、NVIDIA 以及美国能源部(DOE)达成三方深度绑定,在俄亥俄州锁定了高达 8 吉瓦(8 GW-IT,即 8000 兆瓦) 的庞大数据中心园区。
  • 签下长达 20 年的超长租约,全园区独家部署 NVIDIA 最新的顶级 AI 计算集群。
  • 黄仁勋的 NVIDIA 亲自下场,向 SB Energy 注资 15 亿美元,并为首期基础设施提供最高约 1050 亿美元的信用支持。

8000 兆瓦是个什么概念?这相当于数座大型核电站的满负荷输出,足以支撑起数百万家庭的城市运转。

在 7 月底,OpenAI 就曾对外透露:依靠生产环境 GPU 底层算子(Kernel)优化与推测解码(Speculative Decoding)技术,他们已经把端到端推理服务成本生生压榨掉了 20% 以上

把技术架构的极限压榨,与远期数千兆瓦级的基建布局相结合,OpenAI 正在形成恐怖的“规模飞轮”: 算力规模越大,单 Token 边际成本就越低;边际成本越低,就越敢降价放水;涌入的开发者越多,海量流水反过来继续摊薄庞大园区的基建成本。

OpenAI 总裁 Greg Brockman 在转发布局时留下一句野心勃勃的话:“我们的方向很明确:在市场上为客户提供任意任务的最低价格,以及无可争议的最高能力上限。

开发者狂欢背后的冷静:一场两线作战的生存游戏

面对从天而降的折扣,开发者社区真的只剩一片欢呼吗?

并不尽然在最初的亢奋过后,冷静而深刻的理性声音开始占据前排。

知名 Infra 架构分析师 Ashutosh Tiwari 发出行业预警:“一次临时的模型折扣可以改变调用门槛,系统架构则应保持稳定。重新核算你的单元经济模型吧,但请把你的兜底方案和总预算,死死锚定在永久价格上限上。”

▲ 业内分析师提醒开发者:不要为了短期促销轻易重构核心架构

不少资深工程师也纷纷跟进指出:对于严肃的生产环境来说,稳定的并发速率限制(Rate Limits)和可用性,远比三个月的 20% 打折重要得多。更何况,官方白纸黑字写着促销“至少到 11 月 21 日”,三个月后是恢复原价还是推出 GPT-5.7 迭代?没人能打包票

更宏大的视角,则来自开发者社区对整个大模型格局的深刻洞察,闭源双巨头正在经历一场残酷的“两线作战”

▲ 开发者指出:OpenAI 与 Anthropic 既要互掐,又要防御开源地板

一位开发者在热帖中一针见血地写道:

“OpenAI 和 Anthropic 正在打一场两线战争:正面战场上,他们要在复杂的深度推理基准测试中死咬彼此;但在背后,他们必须拼死阻止开发者全盘出逃至极低成本的开源权重模型或深度蒸馏模型。如果你的每 Token 推理价格不能压到接近开源成本的地板,那些来自百亿数据中心协议的规模经济,将毫无意义。”

这就是为什么 OpenAI 在 7 月底先把轻量级模型 Luna 砍掉 80% 价格去贴地肉搏,紧接着又在 8 月下旬对旗舰 Sol 挥刀下调 33% 探底。

它既要防守地面上疯狂涌现的低成本开源方案,又要在天花板上把 Anthropic 的高端旗舰逼进死胡同。

智能的“工业化通缩”时代来了

从 2023 年 GPT-4 那个昂贵、迟钝且只有 8k 视野的蛮荒时代,到今天 GPT-5.6 Sol 以 4/20 美元的白菜价处理海量多模态与复杂 Agent 工作流,我们仅仅用了三年。

这三个月的限时降价,就像是硅谷巨头推开未来大门时透出的一道缝隙:

大模型早已脱离了单纯比拼论文和 Benchmark 得分的象牙塔阶段,它正全速坠入重工业化、电力化、资产负债表化的残酷绞肉机。

在未来的战场上,谁拥有最聪明的“大脑”固然重要;但更可怕的赢家,永远是那个能把最高等级的智慧,变成像自来水和电网一样廉价、充沛、且让所有人欲罢不能的基础设施巨兽。

这场降价风暴才刚刚刮起,而属于大模型暴利时代的倒计时,已经彻底归零。