乐于分享
好东西不私藏

突发!OpenAI深夜掀翻牌桌:顶配旗舰狂降33%,Anthropic被逼入墙角!

突发!OpenAI深夜掀翻牌桌:顶配旗舰狂降33%,Anthropic被逼入墙角!

北京时间凌晨 3 点半,硅谷的夜空还没亮,AI 圈的开发者群已经热闹起来。

OpenAI 官方账号毫无预警地宣布:在未来 3 个月内,其最顶级的旗舰模型 GPT-5.6 Sol,API 与积分价格全线下调超过 20%!

开发者社区很快开始讨论这次调价一场重塑生成式 AI 产业格局的价格洗牌已经拉开序幕。

长期以来,各大模型厂商心照不宣的“价格默契”被彻底撕碎。当行业老大不仅在技术指标上领跑,还要在价格上把竞争对手逼到死角时,整个大模型江湖的生态,正在经历一场惊心动魄的地震。

刀法精准:直接砍向“皇冠上的明珠”

先把账算明白这一次降价瞄准了旗舰 Sol,堪称一次极具杀伤力的定点突袭

很多普通用户看到新闻的第一反应可能是:“那我买的 ChatGPT Plus 每月 20 美元会不会更划算?”

答案是:月度订阅并未因此变得更划算。

OpenAI 在后续跟帖中明确划清了界限:ChatGPT Pro、Plus 和 Business 等面向终端用户的月度订阅用量保持不变这次降价的核心受益者,是通过 API 调用模型的开发者、企业客户,以及消耗 ChatGPT Work 和 Codex credits 的高端生产力团队。

简单来说,如果你把大模型比作自来水,普通订阅用户买的是“包月水卡”,而这次大降价,降的是给工业级大客户按方计费的“管道批发水价”。

▲ OpenAI 开发者社区公布的各档位模型详细新旧价格对照表(单位:美元 / 百万 tokens)

翻开官方公布的价目表,你会发现这次调价的刀法有多凶狠:

  • 输入价格(Prompt)
    :从过去的 $5.00 / 百万 tokens,直接降到 $4.00,降幅整整 20%
  • 缓存输入(Cached Input)
    :从 $0.50 降到 $0.40
  • 输出价格(Completion)
    :原本高高在上的 $30.00 / 百万 tokens,被一刀砍到了 $20.00,降幅高达 33.3%

在 AI 的调用成本中,“输出 tokens”(即模型思考后写出的代码、文章和长推理)向来是最贵的一块。输出成本骤降三分之一,意味着那些极度依赖长程推理、多轮 Agent 自主纠错、以及长篇代码生成的复杂应用,开发成本将迎来断崖式下跌。

两段式绞杀:三周前布下的连环局

这次动作延续了 OpenAI 三周前的调价。将时间线拉长,一场精密的两段式绞杀浮出水面:

在 GPT-5.6 家族的命名体系中,带有浓厚的太阳系意象:Sol(太阳,顶级旗舰)Terra(地球,中端主力)Luna(月亮,极速轻量)

▲ OpenAI 开发者社区公布 7 月底 Luna 与 Terra 的降价及运行效率提升

早在三周前的 7 月 30 日,OpenAI 就已经打响了第一枪:

  • 将轻量级模型 Luna 的价格暴砍 80%,直接砸到 $0.20 / $1.20 的“地板价”;
  • 将中端模型 Terra 降价 20%,压到 $2.00 / $12.00
  • 当时唯独按兵不动的,就是旗舰 Sol

当时业界还在猜测:OpenAI 打算靠中低端走量,同时死守高端旗舰的丰厚利润。

然而仅仅过了三周,当所有竞争对手还在疲于应对中低端价格战时,OpenAI 突然回马一枪,直接在旗舰 Sol 上打出折上折。这一招“低端先围城、高端再拔寨”的组合拳,彻底打乱了竞争对手的阵脚。

刺向软肋:Anthropic 的旗舰防线被击穿

在这场风暴的正中心,承受最大压力的无疑是 OpenAI 的宿敌,Anthropic

▲ 主流第三方平台追踪的 Anthropic 模型价目表

我们把行业里最顶尖的几款旗舰大模型拉到同一张擂台上看一眼标价(每百万 tokens 输入/输出):

  • GPT-5.6 Sol(促销后)
    $4 / $20
  • GPT-5.6 Sol(标准原价)
    :$5 / $30
  • Claude Opus 5
    $5 / $25
  • Claude Fable 5
    $10 / $50

在这一轮促销落地后,GPT-5.6 Sol 的输入与输出价格,已经全面低于 Claude Opus 5而面对 Anthropic 标价高达 $10 / $50 的顶配型号 Fable 5,Sol 甚至只有对方价格的 40%

▲ 开发者 Haider 分享的 CursorBench 评测:横轴为每项任务实际花费成本,纵轴为能力得分

更残酷的现实在于“真实使用成本”知名开发者 Haider 晒出的 CursorBench 实测数据揭示了一个痛点:在大模型写代码、跑 Agent 任务时,由于复杂的自我检查和上下文循环,Fable 等高价模型的每任务综合成本居高不下。

而眼下的 Anthropic 正处于多事之秋:Claude Opus 5 面临社区口碑波动,超强模型 Fable 5 在订阅端又因算力紧张而频频遭遇严格的速率限制(Rate Limits)。

OpenAI 选择在此时亮出价格底牌,无疑是在对方最脆弱的防线上狠狠补了一刀。

正如知名科技分析师 Chubby 指出的那样:

“这是向最大竞争对手 Anthropic 释放的明确信号。在对手面临公关压力与速率限制困扰的时刻,这是一个极其聪明的策略:在加压的同时,将 OpenAI 塑造成更具性价比的终极替代方案。”

算力怪兽的底气:8 吉瓦超级基地与自我进化的模型

为什么 OpenAI 敢于在旗舰模型上大打价格战?难道他们不怕巨额亏损吗?

答案藏在两条看似平行的技术与基建线索里。

1. 模型在帮自己“省钱”

在 7 月底的调价说明中,OpenAI 曾低调披露过一个关键细节:GPT-5.6 已经被深度用于优化自身运行时的生产内核与推测解码算法

简单说,就是让 AI 自己想办法帮服务器优化代码,直接带来了 约 20% 的服务成本下降 以及 超过 15% 的 token 生成效率提升自己的技术突破转化成了真金白银的成本空间,这才有了降价让利的底气。

2. 算力基建的“核动力航母”

另一重底气来自重资产护城河就在降价前夕,业界曝出 OpenAI 与能源巨头及英伟达达成了一项惊天协议:

  • 在美国俄亥俄州锁定容量高达 8 GW(吉瓦) 的超级数据中心园区;
  • 租期长达 20 年,英伟达提供高达 1050 亿美元 量级的信用支持与排他硬件供应。

英伟达 CEO 曾用三个词概括 AI 下半场的决胜点:“LPS”(Land 土地、Power 电力、Shell 建筑外壳)

当同行还在为当下的 GPU 租赁价格精打细算时,OpenAI 已经在用未来几十年的电力和厂房,锁定大模型推理的长期规模效应。算力成本的复利一旦启动,降价就从“伤敌一千自损八百的肉搏”,变成了降维打击的“体系化收割”。

毒辣的阳谋:为什么偏偏是“限时 3 个月”?

细心的开发者一定注意到了官方公告里的一个关键词:“for the next 3 months”(未来 3 个月,至少持续至 2026 年 11 月 21 日)

这是自 2022 年大模型爆发以来,极为罕见的针对同一个旗舰模型 ID 的限期促销

为什么不直接宣布永久降价,却挂上一个“倒计时牌”?这个期限构成了整套商业策略中最毒辣的工程心理学阳谋

1. 制造极高的“迁移摩擦力”

对于企业和开发者而言,切换模型远比在网页上点个按钮复杂。你需要重构 Prompt(提示词)、重新调试温度与上下文参数、重写评测集、重新做安全护栏对齐。

3 个月的优惠窗口期,足够让大量企业把关键生产流水线和长程 Agent “试探性”地迁移到 GPT-5.6 Sol 上。而一旦业务逻辑跑通、代码管道绑定完成,用户对生态的依赖就已经形成三个月后哪怕价格回调,高昂的工程迁移成本也会让企业选择继续留下。

2. 精准打击对手的现金流

在接下来的 90 天里,任何准备调用 Anthropic 或其他高价模型的企业采购负责人,在签字前都不得不面对灵魂拷问:“既然 Sol 只要 $4/$20,我们为什么要在竞品上多花 30% 到 60% 的预算?”

这 3 个月,是抢夺企业年终预算与大客户合同的关键窗口期。

终局展望:模型正在通缩,开发者是唯一赢家

纵观整部大模型演进史,推理成本的剧烈通缩是一条不可逆转的物理铁律。

从早期的 GPT-3.5 到后来的 GPT-4o mini,再到如今层出不穷的开源与超低价模型,同等智能水平的调用成本每年都在以数倍乃至数十倍的速度向下崩塌。

但在过去,价格雪崩往往发生在“退役的老旧模型”或“轻量级小模型”上。而这一次,战火终于正式蔓延到了代表人类最高智慧结晶的超级旗舰本身。

无论 11 月 21 日促销期满之后,OpenAI 选择维持原价还是顺水推舟永久降价,潘多拉的魔盒已经打开:高高在上的顶配 AI,再也不可能躺在算力溢价的温床里高枕无忧

对于被高昂 API 账单压得喘不过气的开发者、创业团队和企业架构师来说,最好的时代正在加速到来。

神仙打架,凡人得利,还有什么比看着最聪明的 AI 变得越来越便宜,更让人兴奋的呢?