乐于分享
好东西不私藏

连夜掀翻牌桌!OpenAI旗舰GPT-5.6突袭暴降33%,8000兆瓦算力压境,Anthropic被逼入死角?

连夜掀翻牌桌!OpenAI旗舰GPT-5.6突袭暴降33%,8000兆瓦算力压境,Anthropic被逼入死角?

谁也没想到,OpenAI会在一个毫无预兆的周五凌晨,直接把整个大模型行业的牌桌给掀了。

北京时间8月22日凌晨,OpenAI官方突然公布重磅消息:旗舰大模型 GPT-5.6 Sol 的 API 与积分价格,即日起全线下调超过20%

▲ OpenAI官方宣布GPT-5.6 Sol限时降价超过20%

消息一出,硅谷开发者社区瞬间炸锅

OpenAI总裁格雷格·布罗克曼(Greg Brockman)随即下场转发,写下了一句充满杀气的宣言:“我们的方向,是给客户在市场上处理任何任务的最低价格,以及最高的能力上限。”

▲ Greg Brockman在X上转发并强调OpenAI的定价野心

翻译成大白话就是:OpenAI想用顶尖能力配上低价,尽量压缩对手的空间。

OpenAI工程师Sherwin Wu更是感慨万千地晒出历史对比:在2023年GPT-4刚发布时,百万token的调用成本高达 $30 / $60而今天,代表人类最前沿智能的GPT-5.6 Sol,直接杀到了 $4 / $20

三年时间,算力成本跳水式崩塌

▲ OpenAI工程师Sherwin Wu对比2023年GPT-4与今日GPT-5.6 Sol的惊人差价

这场看似普通的产品打折,背后还有更庞大的商业布局。

把这几天的所有线索串联起来,8000兆瓦(8 GW)的巨型算力基地签约、企业采购真实数据的变化、Anthropic高价旗舰模型的市场表现,这场降价带着清晰的竞争意图。

刀法精准的手术刀:输入降20%,输出暴砍33%!

把账本摊开,看看OpenAI这次到底动了哪块蛋糕。

很多不写代码的读者可能对大模型的计费方式感到陌生。其实非常简单:大模型API收费就像打车,是按“Token”(可以通俗理解为字数切片)来计费的。

一次完整的AI对话,由两部分组成:

  1. 输入(Input)
    :你发给AI的提示词、长文档、参考资料。
  2. 输出(Output)
    :AI思考后吐给你的回答、代码和分析。

在过去,各家大模型最贵的地方都在输出生成内容需要模型深入推理,也会占用显卡更长的计算时间。

▲ OpenAI官方开发者社区公布的降价对照表

而根据OpenAI官方开发者文档和社区公开的价目表,这次GPT-5.6 Sol的降价刀法极其狠辣:

  • 输入价格
    :从原来的 $5.00 / 百万tokens 降至 $4.00,降幅正好是 20%
  • 缓存输入(Cached Input)
    :从 $0.50 降至 $0.40,同样降幅 20%
  • 输出价格
    :直接从 $30.00 / 百万tokens 狂砍到 $20.00降幅高达 33.3%

这就是为什么官方口径称“综合降价超过20%”。他们把最大的让利,狠狠砸在了最烧钱、最决定企业账单的“输出”侧!

对于如今动辄让AI写几千行代码、跑多步自主Agent(智能体)的开发者来说,输出Token占据了大头账单。这一刀砍下去,真实系统的调用成本直接被削去了将近三分之一。

这次降价直接覆盖了API开发者、Codex积分以及ChatGPT Work的积分用户;面向普通消费者的Pro、Plus和Business个人订阅用量保持原样。

而且,官方在价格页的脚注里明确标注了一个关键时间节点:本次促销价至少持续到 2026年11月21日

整整三个月的降价窗口期,OpenAI到底想干什么?

冷酷的真相:最强最贵的大模型,突然卖不动了?

答案就藏在企业级市场的真实残酷数据里。

就在降价宣布前十天,美国企业支出追踪机构 Ramp 刚刚发布了2026年8月的《AI指数报告》。这份覆盖了海量美国真实企业采购账单的报告,揭开了一个令所有AI巨头冷汗直流的秘密。

▲ Ramp 2026年8月AI指数报告:企业级大模型支出暗流涌动

在企业采用率上,Anthropic 凭借 Claude 积累的优秀口碑,抢占了 43.5% 的企业客户份额,甚至压过了 OpenAI 的 39.7%

然而,Anthropic 推出的“皇冠明珠”,售价高达 输入 $10 / 输出 $50 的地表最贵旗舰 Claude Fable 5,在上线首月遭遇了严重的“市场水土不服”:

  • 它只占到了 Anthropic 自身 Token 消耗总量的 6%
  • 只占到了客户模型总支出的 11.4%
  • 在总支出贡献上,标价极高的 Fable 5,竟然只有 OpenAI 旗舰 Sol 的 75% 左右。

反观降价前的 GPT-5.6 Sol,哪怕标价 $5/$30,也稳稳吃下了 OpenAI 内部 25% 的 Token 用量和 23% 的企业支出

▲ Anthropic官方定价文档:Claude Fable 5标价高达 $10 / $50

企业客户会认真算账,AI暴利神话正在破灭。

在实验室里,大模型测基准分(Benchmark)可以不计成本;但在真实商业世界里,企业老板要算投资回报率(ROI)。如果一个模型在跑分上只比别人高 5%,单价却贵出整整一两倍,没有任何理性采购会当这个冤大头。

此时此刻,Anthropic 的软肋已经彻底暴露。

OpenAI 敏锐地抓住了这个空档,手起刀落,把 Sol 降到 $4 / $20

  • 比起 Anthropic 的顶级旗舰 Fable 5($10/$50),Sol 现在直接便宜了 60%
  • 哪怕比起 Anthropic 的次旗舰 Opus 5($5/$25),Sol 竟然还要再便宜 20%

用顶级旗舰的智商,卖比对方次旗舰还便宜的价格。 这一记重拳,直接把 Anthropic 逼到了进退维谷的墙角。

掀桌的底气:俄亥俄州8000兆瓦超级怪兽

很多人会问:OpenAI 这么疯狂降价,难道不怕亏钱吗?

就在降价前仅仅4天,2026年8月17日,OpenAI 官方悄悄发布了一则极具战略意义的公告:《OpenAI 加入 PORTS-Pike 项目》。

公告白纸黑字写着:OpenAI 联合软银旗下的 SB Energy、英伟达(NVIDIA)以及美国能源部,在俄亥俄州锁定了一个规划容量高达约 8 吉瓦(8 GW-IT,即8000兆瓦)的巨型数据中心园区!

这是个什么概念?1吉瓦等于10亿瓦特8吉瓦的电力,足够点亮数百万个普通家庭,堪比数座大型核电站的满负荷输出!

根据协议细节:

  • SB Energy 负责建设并运营该园区,给 OpenAI 签下了长达 20年的超级租约
  • 园区将独家全量部署英伟达下一代顶级 AI 算力;
  • 英伟达更是直接向 SB Energy 注资 15亿美元,并提供了初始规模高达 4.25 GW-IT 的信用担保(业内披露整体担保支持最高达上千亿美元)。

当其他大模型初创公司还在为几万张显卡的电费发愁、到处求爷爷告奶奶找算力配额的时候,OpenAI 已经把未来二十年的电力和基础设施直接锁死到了工业级极限。

再加上7月底 OpenAI 在工程端实现的 GPU 内核优化(端到端服务成本压降 20%)和投机解码加速(Token生成效率提升超15%),算力工业化带来的边际成本暴跌,给 OpenAI 的前端降价提供了底气!

它正在把算法服务推向自来水和电网式的基础设施生意。

开发者狂欢与清醒者警告:“改得了门槛,改不了架构”

社媒上,全球开发者的情绪被彻底点燃。

科技评论人 Chubby(@kimmonismus)发文指出,OpenAI 的一连串动作展示了其飞轮效应:巨额基础设施投资转化为工程效率,效率转化为更低价格,由此挤压对手空间。

但在一片狂欢声中,资深架构师们却保持着极其冷峻的理性。

知名AI基础设施研究者 Ashutosh Tiwari 在 X 上发出了一条高赞警告:

“临时性的模型降价可以改变业务门槛,系统架构仍应保持稳定。OpenAI 这次降价三个月,你可以重新计算单位经济模型,系统预算和降级备用方案(Fallback)依然应围绕长期价格上限来设计。”

▲ 资深工程师提醒开发者:临时折扣不要动摇核心架构

另一位开发者 Gill 则一针见血地戳中了当下的工程痛点:

“降价确实很爽,但各家 API 那卡死人的速率限制(Rate Limits),依然到处在折磨人!”

▲ 开发者指出降价之外速率限制依然是生产环境痛点

这些清醒的声音道出了AI落地的现实:降价只是敲门砖。

对于生产环境的工业级应用,三个月的限时折扣可以视为一场让大家“放心大胆跑复杂Agent”的盛大公测。到了11月21日之后,是原价恢复、延续降价,还是直接推出架构更轻、效率更高的新模型?这依然悬在所有人头顶

终局之战:大模型暴利时代的终结

回看过去一个月的整个棋局,OpenAI 的排兵布阵堪称教科书级别:

  1. 7月30日,扫荡下盘
    :先把入门级的 Luna 价格暴砍 80%,中端 Terra 砍 20%,在地板价上狙击各种开源小模型与蒸馏模型;
  2. 8月17日,大秀肌肉
    :官宣俄亥俄州 8000 兆瓦超大型数据中心,锁定二十年算力能源底座;
  3. 8月21日,直插心脏
    :旗舰 Sol 限时暴降超20%(输出砍33%),用比竞品次旗舰还低的价格,直接向高溢价的 Anthropic Fable 5 宣战。

这一套连环重拳砸下来,传达出的信号无比清晰:

大模型靠“秀参数卖天价”的暴利时代,正在被彻底终结。

未来的AI竞争将同时考验算法能力、算力工厂的规模、推理能耗和每一度电转化出的 Token 成本。

正如 Greg Brockman 所言,他们正在同时推高能力的上限,并砸穿价格的底线。

牌桌已经被掀翻,旧的定价秩序轰然崩塌。留给其他选手的选择,已经不多了