

北京时间2026年8月22日凌晨,OpenAI在官方账号宣布:未来三个月,旗下旗舰模型 GPT-5.6 Sol 的 API 及积分定价下调超过 20%,其中输出价格降幅达到 33%!
官方定价文档还标明:促销价格至少持续至 2026 年 11 月 21 日。

▲ OpenAI 官方发布5秒极简视频海报,宣布旗舰模型 Sol 开启限期大促
这场限期降价很快被外界视为针对竞争对手的商业攻势。
过去半年里,Anthropic 凭借 Claude 系列在代码生成与长逻辑推理上的优异表现,从 OpenAI 手中抢走了大批核心极客与企业客户;然而,高昂的账单、令人抓狂的速率限制以及日益收紧的安全护栏,让开发者们积怨已久。
就在对手阵脚微乱的瞬间,Sam Altman 拔出了价格屠刀,直插行业最敏感的心脏。
账单直接砍掉三分之一:这场“打折”到底动了谁的蛋糕?
要看懂这次调价的威力,首先得剥开大模型计费的神秘面纱。
很多人对大模型的收费没有概念在工业界,大模型通常按 Token(词元) 计费。你可以把它通俗地理解为汉字或单词的碎片,100万个 Token 大致相当于 75 万个英文单词或一本中篇小说的体量。
API 计费通常拆成两半:输入(Prompt) 和 输出(Completion)。输入就像是你上车时给司机看的地图,输出则是出租车跑出的里程。在复杂的 AI 代理(Agent)工作流中,AI 会反复推理并生成大量代码,输出 Token 往往占据企业预算的大头。
根据 OpenAI 开发者社区与官方定价页公开的对照数据,此次调价的明细极其惊人:

▲ 社区讨论中整理出的新旧价格对照表(单位:美元/百万 tokens)
- GPT-5.6 Sol(旗舰)
:输入从 $5.00 降至 $4.00(降幅 20%);缓存输入从 $0.50 降至 $0.40;输出更是直接从 $30.00 狂砍至 $20.00(降幅高达 33.3%)! 对比 7 月底已经降价的同门师弟:中档主力 Terra 维持在 $2.00 / $12.00;轻量级速度之王 Luna 早已杀到了白菜价 $0.20 / $1.20。

▲ 官方补充说明:降价覆盖 API、ChatGPT Work 与 Codex 积分,但个人订阅用量规则不变
不过需要给普通用户泼一盆冷水:如果你购买的是 ChatGPT Plus/Pro 网页版,对话额度并不会因此翻倍。 公告明确说明,Pro、Plus、Business 订阅用量保持原样。
这次优惠主要面向按 Token 结算的 API 调用者、Codex 积分消耗者以及符合条件的 ChatGPT Work 团队。OpenAI瞄准的是生产力一线,以及掌握代码库和企业采购权的技术团队。
狙击Anthropic:当AI王牌遇上“配额刺客”与“天价账单”
AI圈的知名分析者 Kenshi 发推一语中的:“OpenAI 正在将压力成倍推给 Anthropic。”

▲ Kenshi 认为竞争已经从纯跑分演变为价格、容量与自由度的综合博弈
回顾当下的前沿战场:Anthropic 旗下的 Claude Opus 5 定价为 $5 / $25,而能力极其强悍但极其昂贵的 Claude Fable 5 更是高达惊人的 $10 / $50。
在过去,很多工程师宁愿忍受高价也要用 Claude,因为其逻辑严密、代码幻觉少。但随着各大企业把 AI 接入几十步甚至上百步循环的自动化流程,成本、拒绝回答和配额紧张等问题开始集中显现,工作流还可能因“速率限制”(Rate Limit)中断。
开发者 Haider 在社交平台上晒出了一张来自 CursorBench 的深度评测图表,直言:“Anthropic 当前最硬的基准测试,恐怕是他们的定价。”

▲ CursorBench 成本坐标图:在接近 70% 得分区间的顶级模型中,不同模型的单任务成本可相差数倍
这张图揭示了一个残酷的行业现实:在跑分无限接近的顶峰区间,不同模型的“每任务实际花费”(Cost per Task)差出了数倍之巨。 Fable 5 固然惊艳,但完成一个复杂编程任务的烧钱速度令人咋舌;而现在,原本就处在第一梯队的 GPT-5.6 Sol 把输出干到了 $20,直接在标价上全面击穿了 Claude Opus 5($25)和 Fable 5($50)。
当性能差异缩窄到只有少数极客能察觉的百分点时,33% 的硬性成本落差就会成为企业财务总监(CFO)挥向竞品的裁决之剑。
阳谋与锁喉:带“保质期”的价格战,究竟有多毒辣?
在这场大降价中,最具戏剧性也最引发行业深思的,是那个“仅限未来三个月(至 11 月 21 日)”的期限条款。
德国科技观察家 Florian 敏锐地指出:“前沿模型的价格战,现在居然带上了促销到期日。”

▲ 社区资深观察者提醒大家关注促销到期机制对企业预算模型的冲击
很多人不解:大模型技术持续进步、成本也在下降,为什么降价还要设“保质期”?
这类限期优惠会形成一种“工作负载锁定”(Workload Lock-in)效应。
在软件工程中,把一套庞大的企业系统从模型 A 迁移到模型 B,远比在后台改一行 API Key 复杂。工程师必须重写大量 Prompt 提示词模板、重新调试防幻觉的结构化输出拦截器、重新跑通测试集(Evals)。这种隐性的“工程迁移成本”极其高昂
OpenAI 此时给出一个三个月的“黄金打折期”,就像是在向所有犹豫不决的企业发出邀请函:
“来吧,现在迁移过来,成本直接打骨折,你可以用极低的预算把下半年的核心产品全部跑在 Sol 上。”
而一旦各大企业的技术架构和工程代码在三个月内深度适配了 GPT-5.6 Sol 的生态,到了 11 月下旬,如果 OpenAI 恢复原价,又有几家公司愿意冒着业务中断的风险,再花几个月把系统重构回竞品阵营?
以短期让利换取长期生态垄断,这是一场阳谋。
底气何在?俄亥俄8GW电力怪兽与算力“复利”
OpenAI 扩张算力基础设施的动作,也被评论者视为其降价空间的来源之一。
就在几天前,外媒 The Decoder 爆出一条惊天基建新闻:OpenAI 正式在俄亥俄州锁定了约 8 GW(吉瓦)IT 容量的巨型算力园区(PORTS-Pike),租期长达 20 年;而英伟达则以高达 1050 亿美元规模的信用与资产支持深度介入,成为首期排他性芯片盟友。
8 个吉瓦是什么概念?这相当于数个大型核电站机组的总发电量,足以点亮数百万户家庭。黄仁勋曾用 “LPS”(Land 土地、Power 电力、Shell 楼宇建筑) 来形容下一代 AI 算力的终极瓶颈,而 OpenAI 正在把这些工业怪兽级别的资源迅速转化为生产力。
知名技术评论人 Chubby(@kimmonismus)分析道:
“OpenAI 早期在自建基础设施、推测解码(Speculative Decoding)以及利用 GPT-5.6 自我优化底层运行时上的激进投入,正在形成‘复利效应’。服务成本下降了 20%,Token 生成效率提升了 15% 以上。真实的工业规模效应正在转化为竞争筹码。”
从 7 月底将轻量模型 Luna 暴砍 80% 扫荡低端市场,到如今对皇冠上的明珠 Sol 限期降价 33% 攻坚高端大厂,OpenAI 已经建立起一套层次分明、攻守兼备的阶梯式定价矩阵。
终局之战:大模型告别“唯跑分论”,进入残酷的工程算术时代
这一轮降价潮宣告了一个时代的落幕:大模型靠几个基准跑分榜单(Benchmarks)就能漫天要价的“神仙打架”时代,彻底结束了。
取而代之的,是一个精打细算、血肉横飞的“工程算术时代”。对于全球数百万开发者和企业而言,选择一个模型的考量维度正在被彻底重塑:
- 单位任务的综合拥有成本(TCO)
,远比虚无缥缈的“智商跑分”重要; - 稳定的并发吞吐与宽松的用量限额
,远比苛刻的安全拦截更有生产力; - 多模型混合调度(Routing)
成为刚需,用最便宜的 Luna 负责前置分流与数据清洗,用打折后的 Sol 攻坚核心逻辑与架构设计,正在成为顶尖团队的标准范式。
这场由 GPT-5.6 Sol 降价点燃的战火才刚刚烧起。接下来三个月,压力球被结结实实地踢到了 Anthropic、谷歌以及一众开源模型阵营的脚下。
没有人能永远躺在高价的王座上对于屏幕前所有日夜构建 AI 应用的开发者来说,最好的时代,终于随着这场价格雪崩,呼啸而来了。

夜雨聆风