AI 领域的战争,从来不打招呼
就在所有人以为大模型军备竞赛已经进入僵持阶段时,OpenAI 突然毫无预警地在社交平台上甩出一条仅有几秒的短视频。
发布会与大规模预热全部省去,画面里只留下一句冷酷的宣判:GPT-5.6 家族最顶级的旗舰模型 Sol,即日起 API 价格全线下调超过 20%,其中最核心的输出端计费直接暴砍 33.3%!

▲ OpenAI 官方发布降价视频:GPT-5.6 Sol 降价超过 20%
消息一出,整个硅谷与全球开发者社区瞬间炸锅。
因为就在几天前,OpenAI 刚刚宣布锁定了约 8000 兆瓦(8 GW-IT)的史诗级超级电力园区。一边狂吞能源筑造算力帝国,一边反手把自家最聪明的旗舰模型价格打到骨折,这种“左手屯粮、右手掀桌”的打法,直接把最大的死敌 Anthropic 逼到了墙角。
大模型的天,又变了
掀桌子的艺术:最贵的大脑,直接打到骨折
我们要先看懂这一刀到底砍得有多深。
大模型 API 的计费方式,通俗来说就是按 Token(字词片段) 算钱。通常以“每百万 Token 多少美元”来标价。整个收费大致分为两部分:你发给模型的输入(Input),以及模型吐给你的输出(Output)。
在复杂任务和智能体(Agent)时代,模型不仅要读指令,还要反复思考、调用工具、生成海量代码和长篇报告。因此,输出端的价格往往决定企业账单的厚度。
OpenAI 官方给出的新旧价目表,堪称一次精准的定点爆破:

▲ OpenAI 开发者文档最新定价:Sol 模型输入降至 4 美元,输出降至 20 美元
- 输入价格
:从原来的 5.00 美元 / 百万 Token,直接降到 4.00 美元,降幅整整 20%; - 缓存输入
:从 0.50 美元 降到 0.40 美元,降幅 20%; - 输出价格
:最狠的一刀落在这里,从原先的 30.00 美元 / 百万 Token,一路狂跌到 20.00 美元,单项降幅高达 33.3%!
官方宣称“总体降价超过 20%”对于重度依赖大模型输出复杂逻辑的开发者来说,这相当于整个工作流的调用成本直接缩水了近三分之一。

▲ 开发者社区整理的价格表:Sol、Terra 与 Luna 的价目变化清晰可见
这一刀也直接刺向了死对头 Anthropic 的软肋。
我们把两家的公开报价单摆在同一张台面上:
- Anthropic 顶级旗舰 Claude Fable 5
:输入 10 美元 / 输出 50 美元; - Anthropic 次旗舰 Claude Opus 5
:输入 5 美元 / 输出 25 美元; - 降价后的 OpenAI GPT-5.6 Sol
:输入 4 美元 / 输出 20 美元。
算完这笔账,所有人倒吸一口凉气:Sol 现在的价格,只有 Fable 5 的 40%(便宜了整整 60%);甚至比 Anthropic 的次旗舰 Opus 5 还要再便宜 20%!
OpenAI 总裁 Greg Brockman 随后在社交媒体上写道,他们的方向十分明确:为客户在市场上的任意任务提供最低价格,同时提供最高的能力上限。
算力通胀的恐怖拐点:3年降价85%,智能正在沦为自来水
把视线拉长,这种降价节奏背后显出一种迅猛的技术通胀。
OpenAI 员工 Sherwin Wu 在转发降价公告时忍不住感慨:现在的 Sol 是 4 / 20 美元;而回看 2023 年初代 GPT-4 API 上线时,价格曾高达 30 美元输入 / 60 美元输出,而且上下文窗口只有可怜的 8k。

▲ Sherwin Wu 调侃 2023 年 GPT-4 与今日 Sol 的天壤之别
短短三年时间,模型的推理能力翻天覆地,支持的上下文动辄百万级别,而单位智能的采购价格却暴跌了近 85% 到 90%。
这就是大模型领域的“新摩尔定律”
早在三周前的 7 月 30 日,OpenAI 就已经对 GPT-5.6 家族的中低端梯队开过一轮杀戒:入门档 Luna 的价格被直接砍掉了 80%(低至 0.20 / 1.20 美元),中端主力 Terra 降价 20%。当时官方给出了解释:得益于生产环境 GPU Kernel(底层计算核心代码)的优化,端到端服务成本压降了约 20%,投机解码技术更是让 Token 生成效率提升了 15% 以上。
先用骨折价的 Luna 和 Terra 在低端市场扫荡开源生态和便宜模型,筑牢护城河;紧接着在高端战场对旗舰 Sol 发起限时突袭(促销期至少持续至 2026 年 11 月 21 日)。
OpenAI 的商业策略像手术刀一样精准:把工程效率优化的每一分红利,全部化作射向竞争对手的价格子弹。
隐秘的裂缝:为什么顶级模型突然卖不动了?
如果只把这次降价看作日常让利,那就太低估背后的凶险了。
就在这次降价发生前几天,美国企业支出追踪机构 Ramp 发布了一份极具冲击力的 8 月 AI 指数报告。报告里藏着一个让整个硅谷大吃一惊的残酷真相:

▲ Ramp 报告揭示企业支出格局:Anthropic 客户占比 43.5%,OpenAI 为 39.7%
虽然在企业客户渗透率上,Anthropic 凭借 43.5% 的份额微弱领先于 OpenAI 的 39.7%,但两家公司的顶级旗舰模型却迎来了完全不同的命运:
Anthropic 倾尽心血打造的“最强大脑”Claude Fable 5,在发布首月,仅仅占到了客户总 Token 用量的 6%、支出份额的 11.4%; 相比之下,标价更亲民的 GPT-5.6 Sol,却一口气吃下了 OpenAI 生态内 25% 的 Token 用量 和 23% 的支出; Fable 5 带来的实际企业总支出,只有 Sol 的 75% 左右。
这是什么概念?
企业客户的钱袋子正在收紧
过去一年里,大模型厂商习惯了在基准测试(Benchmark)上刷出高分,然后标上天价卖给企业。但 Ramp 的经济学家一针见血地指出:企业为“前沿智力”盲目加价的意愿已经触碰到了天花板。
如果一个模型比别人贵一倍,但在实际的写代码、填表格、跑客服流水线时并没有带来一倍的业务提升,严肃的企业采购部门就会毫不犹豫地转身离开,选择性价比更高的次旗舰。
Anthropic 的 Fable 5 标出了 10 / 50 美元的天价,试图维持高端王座,结果却在企业端遭遇了“叫好不叫座”的尴尬。
OpenAI 敏锐地捕捉到了这道裂缝。
既然你高高在上卖不动,那我就在你的软肋上再捅一刀,Sol 直接打到 4 / 20 美元。这一降,彻底粉碎了高价旗舰的生存空间,逼着所有犹豫不决的企业把工作流无脑迁移到 OpenAI 的生态里。
8000兆瓦超级巨兽:算力军阀的终极威慑
这次降价背后的重工业底色,足以让对手感到不寒而栗。
就在降价宣布前 4 天(8 月 17 日),OpenAI 刚刚联合 SB Energy、英伟达(NVIDIA)以及美国能源部,砸出了一份震惊全球能源界的合作协议,PORTS-Pike 超级算力项目。
OpenAI 在俄亥俄州一口气锁定了约 8000 兆瓦(8 GW-IT)的超大规模电力与算力容量,并签下了长达 20 年的超级租约。
8000 兆瓦是什么概念?这相当于数百万普通家庭的用电总和,是一座不折不扣的超级工业能源黑洞。
在这笔世纪交易中,英伟达不仅将独家为该园区供应顶级 AI 芯片,还向建设方 SB Energy 直接注资 15 亿美元,甚至为前期 4.25 GW-IT 的基础设施提供了高达 1050 亿美元 的残值担保支持。
知名科技评论员在 X 上对此发出了直击要害的评论:
“一边进行着 8000 兆瓦的基建狂魔式扩建,一边反手疯狂降价,这足以让所有竞争对手夜不能寐。”

▲ 评论指出:8GW 规模化基建与降价并行,构成了恐怖的竞争壁垒
当别人还在为采购几万张显卡四处借钱时,OpenAI 已经把战场拉到了电网、地皮、变电站和千亿美元级资产负债表的维度。
这解释了为什么 OpenAI 敢掀翻桌子打价格战。
当算力规模庞大到接近公用事业(Utility)的水准时,边际计算成本就会被极度摊薄。这种用重工业基建支撑轻资产软件降价的“算力军阀”打法,正在将后来者的入场门槛抬升到无法企及的高度。
狂欢之后:三个月的窗口期与终极赌局
不过,狂欢的开发者群体并没有完全被低价冲昏头脑。
仔细研读官方说明会发现,OpenAI 留了一个极其微妙的伏笔:本次 Sol 的 4 / 20 美元降价是一次“促销活动”,官方保证至少持续到 2026 年 11 月 21 日(约三个月)。
而且,这次降价仅覆盖 API 接口调用以及 ChatGPT Work、Codex 的积分计费,对于广大的 Pro、Plus、Business 等固定月费订阅用户,用量额度没有任何变化。
在开发者社区里,冷静的声音开始浮现。工程师 Sebastian Buzdugan 就直言不讳地表示:
“如果是为了跑生产环境的真实业务,我宁愿选择稳定可靠的速率限制(Rate Limits),三个月的 20% 临时折扣吸引力有限。”

▲ 开发者指出:生产环境看重稳定性与永久成本预期
老练的架构师们深知,企业的系统架构不能随随便便因为三个月的促销而重构。
三个月之后呢?价格是会回弹到 5 / 30 美元,还是说这本身就是 OpenAI 抛出的“诱饵”,等到 11 月下旬,效率更高的新一代模型顺理成章地接盘,把促销价直接变成永久基准线?
历史的经验告诉我们,大模型的价格战一旦打响,就从来没有倒车可坐。
对于 Anthropic 而言,留给他们调整姿态的时间只剩下不到 90 天;而对于整个 AI 行业来说,这场伴随着 8000 兆瓦轰鸣声的价格风暴,才刚刚吹响前奏。
智能的溢价正在被无情挤干,属于重工业与规模化绞杀的残酷新周期,已经彻底到来了。
夜雨聆风