

谁也没想到,OpenAI会在一个毫无预兆的周五凌晨,直接把整个大模型行业的牌桌给掀了。
北京时间8月22日凌晨,OpenAI官方突然公布重磅消息:旗舰大模型 GPT-5.6 Sol 的 API 与积分价格,即日起全线下调超过20%!

▲ OpenAI官方宣布GPT-5.6 Sol限时降价超过20%
消息一出,硅谷开发者社区瞬间炸锅
OpenAI总裁格雷格·布罗克曼(Greg Brockman)随即下场转发,写下了一句充满杀气的宣言:“我们的方向,是给客户在市场上处理任何任务的最低价格,以及最高的能力上限。”

▲ Greg Brockman在X上转发并强调OpenAI的定价野心
翻译成大白话就是:OpenAI想用顶尖能力配上低价,尽量压缩对手的空间。
OpenAI工程师Sherwin Wu更是感慨万千地晒出历史对比:在2023年GPT-4刚发布时,百万token的调用成本高达 $30 / $60;而今天,代表人类最前沿智能的GPT-5.6 Sol,直接杀到了 $4 / $20!
三年时间,算力成本跳水式崩塌

▲ OpenAI工程师Sherwin Wu对比2023年GPT-4与今日GPT-5.6 Sol的惊人差价
这场看似普通的产品打折,背后还有更庞大的商业布局。
把这几天的所有线索串联起来,8000兆瓦(8 GW)的巨型算力基地签约、企业采购真实数据的变化、Anthropic高价旗舰模型的市场表现,这场降价带着清晰的竞争意图。
刀法精准的手术刀:输入降20%,输出暴砍33%!
把账本摊开,看看OpenAI这次到底动了哪块蛋糕。
很多不写代码的读者可能对大模型的计费方式感到陌生。其实非常简单:大模型API收费就像打车,是按“Token”(可以通俗理解为字数切片)来计费的。
一次完整的AI对话,由两部分组成:
- 输入(Input)
:你发给AI的提示词、长文档、参考资料。 - 输出(Output)
:AI思考后吐给你的回答、代码和分析。
在过去,各家大模型最贵的地方都在输出。生成内容需要模型深入推理,也会占用显卡更长的计算时间。

▲ OpenAI官方开发者社区公布的降价对照表
而根据OpenAI官方开发者文档和社区公开的价目表,这次GPT-5.6 Sol的降价刀法极其狠辣:
- 输入价格
:从原来的 $5.00 / 百万tokens 降至 $4.00,降幅正好是 20%; - 缓存输入(Cached Input)
:从 $0.50 降至 $0.40,同样降幅 20%; - 输出价格
:直接从 $30.00 / 百万tokens 狂砍到 $20.00,降幅高达 33.3%!
这就是为什么官方口径称“综合降价超过20%”。他们把最大的让利,狠狠砸在了最烧钱、最决定企业账单的“输出”侧!
对于如今动辄让AI写几千行代码、跑多步自主Agent(智能体)的开发者来说,输出Token占据了大头账单。这一刀砍下去,真实系统的调用成本直接被削去了将近三分之一。
这次降价直接覆盖了API开发者、Codex积分以及ChatGPT Work的积分用户;面向普通消费者的Pro、Plus和Business个人订阅用量保持原样。
而且,官方在价格页的脚注里明确标注了一个关键时间节点:本次促销价至少持续到 2026年11月21日。
整整三个月的降价窗口期,OpenAI到底想干什么?
冷酷的真相:最强最贵的大模型,突然卖不动了?
答案就藏在企业级市场的真实残酷数据里。
就在降价宣布前十天,美国企业支出追踪机构 Ramp 刚刚发布了2026年8月的《AI指数报告》。这份覆盖了海量美国真实企业采购账单的报告,揭开了一个令所有AI巨头冷汗直流的秘密。

▲ Ramp 2026年8月AI指数报告:企业级大模型支出暗流涌动
在企业采用率上,Anthropic 凭借 Claude 积累的优秀口碑,抢占了 43.5% 的企业客户份额,甚至压过了 OpenAI 的 39.7%。
然而,Anthropic 推出的“皇冠明珠”,售价高达 输入 $10 / 输出 $50 的地表最贵旗舰 Claude Fable 5,在上线首月遭遇了严重的“市场水土不服”:
它只占到了 Anthropic 自身 Token 消耗总量的 6%; 只占到了客户模型总支出的 11.4%; 在总支出贡献上,标价极高的 Fable 5,竟然只有 OpenAI 旗舰 Sol 的 75% 左右。
反观降价前的 GPT-5.6 Sol,哪怕标价 $5/$30,也稳稳吃下了 OpenAI 内部 25% 的 Token 用量和 23% 的企业支出。

▲ Anthropic官方定价文档:Claude Fable 5标价高达 $10 / $50
企业客户会认真算账,AI暴利神话正在破灭。
在实验室里,大模型测基准分(Benchmark)可以不计成本;但在真实商业世界里,企业老板要算投资回报率(ROI)。如果一个模型在跑分上只比别人高 5%,单价却贵出整整一两倍,没有任何理性采购会当这个冤大头。
此时此刻,Anthropic 的软肋已经彻底暴露。
OpenAI 敏锐地抓住了这个空档,手起刀落,把 Sol 降到 $4 / $20:
比起 Anthropic 的顶级旗舰 Fable 5($10/$50),Sol 现在直接便宜了 60%; 哪怕比起 Anthropic 的次旗舰 Opus 5($5/$25),Sol 竟然还要再便宜 20%!
用顶级旗舰的智商,卖比对方次旗舰还便宜的价格。 这一记重拳,直接把 Anthropic 逼到了进退维谷的墙角。
掀桌的底气:俄亥俄州8000兆瓦超级怪兽
很多人会问:OpenAI 这么疯狂降价,难道不怕亏钱吗?
就在降价前仅仅4天,2026年8月17日,OpenAI 官方悄悄发布了一则极具战略意义的公告:《OpenAI 加入 PORTS-Pike 项目》。
公告白纸黑字写着:OpenAI 联合软银旗下的 SB Energy、英伟达(NVIDIA)以及美国能源部,在俄亥俄州锁定了一个规划容量高达约 8 吉瓦(8 GW-IT,即8000兆瓦)的巨型数据中心园区!
这是个什么概念?1吉瓦等于10亿瓦特8吉瓦的电力,足够点亮数百万个普通家庭,堪比数座大型核电站的满负荷输出!
根据协议细节:
SB Energy 负责建设并运营该园区,给 OpenAI 签下了长达 20年的超级租约; 园区将独家全量部署英伟达下一代顶级 AI 算力; 英伟达更是直接向 SB Energy 注资 15亿美元,并提供了初始规模高达 4.25 GW-IT 的信用担保(业内披露整体担保支持最高达上千亿美元)。
当其他大模型初创公司还在为几万张显卡的电费发愁、到处求爷爷告奶奶找算力配额的时候,OpenAI 已经把未来二十年的电力和基础设施直接锁死到了工业级极限。
再加上7月底 OpenAI 在工程端实现的 GPU 内核优化(端到端服务成本压降 20%)和投机解码加速(Token生成效率提升超15%),算力工业化带来的边际成本暴跌,给 OpenAI 的前端降价提供了底气!
它正在把算法服务推向自来水和电网式的基础设施生意。
开发者狂欢与清醒者警告:“改得了门槛,改不了架构”
社媒上,全球开发者的情绪被彻底点燃。
科技评论人 Chubby(@kimmonismus)发文指出,OpenAI 的一连串动作展示了其飞轮效应:巨额基础设施投资转化为工程效率,效率转化为更低价格,由此挤压对手空间。
但在一片狂欢声中,资深架构师们却保持着极其冷峻的理性。
知名AI基础设施研究者 Ashutosh Tiwari 在 X 上发出了一条高赞警告:
“临时性的模型降价可以改变业务门槛,系统架构仍应保持稳定。OpenAI 这次降价三个月,你可以重新计算单位经济模型,系统预算和降级备用方案(Fallback)依然应围绕长期价格上限来设计。”

▲ 资深工程师提醒开发者:临时折扣不要动摇核心架构
另一位开发者 Gill 则一针见血地戳中了当下的工程痛点:
“降价确实很爽,但各家 API 那卡死人的速率限制(Rate Limits),依然到处在折磨人!”

▲ 开发者指出降价之外速率限制依然是生产环境痛点
这些清醒的声音道出了AI落地的现实:降价只是敲门砖。
对于生产环境的工业级应用,三个月的限时折扣可以视为一场让大家“放心大胆跑复杂Agent”的盛大公测。到了11月21日之后,是原价恢复、延续降价,还是直接推出架构更轻、效率更高的新模型?这依然悬在所有人头顶
终局之战:大模型暴利时代的终结
回看过去一个月的整个棋局,OpenAI 的排兵布阵堪称教科书级别:
- 7月30日,扫荡下盘
:先把入门级的 Luna 价格暴砍 80%,中端 Terra 砍 20%,在地板价上狙击各种开源小模型与蒸馏模型; - 8月17日,大秀肌肉
:官宣俄亥俄州 8000 兆瓦超大型数据中心,锁定二十年算力能源底座; - 8月21日,直插心脏
:旗舰 Sol 限时暴降超20%(输出砍33%),用比竞品次旗舰还低的价格,直接向高溢价的 Anthropic Fable 5 宣战。
这一套连环重拳砸下来,传达出的信号无比清晰:
大模型靠“秀参数卖天价”的暴利时代,正在被彻底终结。
未来的AI竞争将同时考验算法能力、算力工厂的规模、推理能耗和每一度电转化出的 Token 成本。
正如 Greg Brockman 所言,他们正在同时推高能力的上限,并砸穿价格的底线。
牌桌已经被掀翻,旧的定价秩序轰然崩塌。留给其他选手的选择,已经不多了

夜雨聆风