

你每个月花 200 美元(约合 1400 多元人民币)买下 OpenAI 最顶级的 Pro 订阅,本以为能彻底告别“算力焦虑”。
结果,打开最强模型 GPT-5.6 Sol 刚写了一天代码,进度条直接归零,一整周的额度,一天之内蒸发得干干净净。
与此同时,社交媒体上开始涌现大批付费用户集体控诉:“我甚至一整天都没怎么用,额度进度条却像水管漏水一样疯狂往下掉!”

▲ BridgeMind 创始人发帖控诉:OpenAI 的额度机制从“行业最好”变成了“行业最差”
面对排山倒海的愤怒,OpenAI 在短短 48 小时内上演了一出极其魔幻的公关拉锯战:先指责用户搞“欺诈共享”,接着突然发糖宣布“送你重置券”,随后又改口说是“缓存命中率太低”,最后反手给 API 降价……
这一连串令人眼花缭乱的走位背后,究竟隐藏着什么?
把它简单归为一次普通的“系统故障”,恐怕会漏掉背后的行业变化。一场悄无声息的大迁徙,正在重塑我们使用 AI 的一切规则。
48小时公关大戏:从“抓小偷”到“发糖果”
事情的导火索,始于全球开发者的集体不满。
几天前,大量 ChatGPT Plus(20美元/月)和 Pro(最高 200美元/月)的付费订阅者发现,自己的 Codex 和 Work 额度消耗速度快得匪夷所思。不仅有人一天干光一周用量,甚至有人发现新老账号的额度耐用度差了整整一个数量级。
8 月 21 日清晨,OpenAI 负责 Codex 与 ChatGPT 产品的核心主管 Tibo 站出来回应。但他抛出的第一句解释,瞬间点燃了整个开发者社区的怒火。

▲ Tibo 解释称许多额度异常与把订阅转成 API 的“sub2api”违规分发有关
Tibo 表示:经过调查,许多额度快速耗尽的用户,是因为在私下使用一种叫 “sub2api” 的工具,也就是把个人的订阅账号转接成 API 流量分发给多个人用。他明确强调,这种行为会被系统的反欺诈风控拦截。
这句话一出,评论区当场炸锅
正规交钱、单人使用的重度开发者们觉得自己被扣上了莫须有的罪名。有用户直接愤怒回呛:“你把所有遇到问题的正常用户都打成欺诈犯,这简直不可理喻!”

▲ 开发者愤怒反击:指责正常付费用户欺诈令人无法接受
眼看舆论即将失控,官方迅速换了一副面孔。
仅仅几个小时后,Tibo 再次发帖,画风突变:“好消息!Codex 活跃用户突破 2000 万!为了庆祝,我们给所有 Codex 和 ChatGPT Work 用户发放一次‘预存重置额度’(Banked Reset)!”

▲ Tibo 借 2000 万活跃里程碑发放 Banked Reset,试图平息额度争议
一边说着“额度系统大体没有异常”,一边火速给全员发“补血包”。这种“打一巴掌再给一颗糖”的操作,并没有让愤怒平息,反而让大家更加笃定:后台的计费逻辑绝对出了大问题。
到了 8 月 22 日,官方给出了第三种解释:“我们发现,本周部分用户的缓存命中率(Cache Hit Rate)低于正常水平,这可能是额度掉得偏快的原因。”

▲ 官方最新技术口径:缓存命中率变差导致扣费加速
但社区已经不再买账有高赞回复毫不留情地回怼:“别再用听起来舒服的说法搪塞了!很多人根本没用额度也在掉,缓存无法解释全部问题!”

▲ 用户质疑:即使不使用额度也在掉,要求官方停止粉饰太平
从“抓违规小偷”,到“发糖庆典”,再到“缓存背锅”,OpenAI 这套闪烁其词的公关剧本背后,到底在掩盖什么?
拆解黑箱:你的 200 刀到底买了什么?
要想看清这场乱局的本质,我们需要先把 OpenAI 复杂的“账单黑话”翻译成大白话。
过去,大家习惯把 ChatGPT 的 20 美元或 200 美元订阅理解为“无限畅饮自助餐”:只要交了月费,在合理范围内就可以随便用。但事实上,OpenAI 的计费中枢早在几个月前就彻底换成了“云服务精密水表”。

▲ OpenAI 官方工程博客《Beyond rate limits》:将限额与按量 Credits 熔铸成实时计算瀑布
1. 三座模型大山:神医、工人与苦力
在目前的 GPT-5.6 家族中,存在着森严的“阶级分工”:
- GPT-5.6 Sol
:家族中的“顶尖专家”,专门啃高难度架构和复杂代码,智商最高,但极度昂贵、额度极少。在 Plus 计划中,每 5 小时可能只允许调用几十到一百次; - GPT-5.6 Terra
:日常生产的“主力干将”,平衡了速度与成本; - GPT-5.6 Luna
:流水线上的“基础苦力”,速度极快、成本极低,额度上限通常是 Sol 的数十倍,在很多场景下甚至接近“无限供应”。

▲ 官方 Rate Card 显示:Luna 标注为近乎无限,而 Sol 则按高额 Credits 扣除
2. 从“按条算”到“按 Token 算”:看不见的火钳
在 2026 年 4 月之前,Codex 的很多额度还是按“消息条数”来粗略计算的。你问一句,就算消耗一条
但从 4 月 2 日起,OpenAI 彻底把计费规则改成了“按 Token(输入、缓存输入、输出)实打实计费”。

▲ 归档记录显示:Codex 于 2026 年 4 月全面切换为 API 级别的 Token 扣费标准
这就带来了一个巨大的隐形陷阱:当你在用 AI 进行现代化的“代理式编程”(Agentic Workflow)时,AI 会自动扫描你的整个代码仓库、阅读上万行上下文、反复生成子任务、在后台进行自动化代码审阅(Auto-review)。
聊天框里的一次回车,可能让后台的 AI 吞吐数百万个 Token。如果这时候缓存命中率一旦下降,每一次上下文重读都必须按全新输入计费,那扣费速度简直就像拿喷火枪烧钱包!
3. 最折磨人的“隐形天花板”
另一处让开发者抓狂的,是 OpenAI 的“黑箱限额”机制。
官方文档明确给出了约 5 小时的滚动窗口限额,但同时在不起眼的角落标注着:“系统可能存在额外的周限额,且周限额具体数值不予公开。”
这就造就了一种极其荒诞的体验:你看得见眼前的小水表,却看不见头顶的大闸门。 很多工程师正写着核心业务,突然之间整个账号被“熔断”,你根本不知道自己触碰了哪条隐形红线。
致命洞察:奥特曼正在砸掉“亏本自助餐”
在这场舆论风暴中,独立调查账号 NIK(@ns123abc)一针见血地指出了 OpenAI 没有明说的商业阳谋:
“OpenAI 正在系统性地把‘非计量’的 ChatGPT 用户,逼向‘按量计费’的 Codex / Work 体系。”

▲ 独立调查账号 NIK 发文指出:OpenAI 正在通过收紧额度平衡算力收入比
这句分析揭开了 AI 巨头们当下最难以启齿的财务困境:包月制,快要被现代 AI 玩崩了。
在 2023 到 2024 年,用户和 AI 的交互大多是“一问一答”,哪怕每天聊上百句,算力成本依然可控。但到了 2026 年,Agent(智能体)接管了世界。一个高阶程序员开着 GPT-5.6 Sol 跑一整天自动化重构,其实际消耗的算力,可能已经远远超过了他支付的 200 美元月费。
每一个高强度的 Pro 用户,都在让 OpenAI 亏钱。
为了扭转算力与收入的失衡,OpenAI 正在布下一盘极其精密的“赶羊入圈”大局:
- 暗中收紧 Sol 的包月包含额度
:通过未公开的周上限和严格的风控,防止重度用户把高端算力薅秃; - 推行“瀑布式”扣费
:包月额度耗尽后,系统不再直接把你踢下线,而是引导你购买按量付费的 Credits(约 4 美分一枚)继续跑; - 把低端模型 Luna 当作“安全岛”
:当你额度耗尽又不想加钱时,系统会把你自动降级/分流到便宜的 Luna 模型上; - 精准降价 API,但绝不补贴包月
:在争议爆发的当天,OpenAI 官方宣布将 GPT-5.6 Sol 的 API 与 Credits 定价下调 20%,但跟帖明确写着:Plus 和 Pro 的订阅包含用量保持不变!

▲ 官方宣布 Sol 降价 20%,但优惠只针对 API 与额外 Credits,订阅包含额度分文未动
看到了吗?单位算力确实在降价,但打折的永远是“按量计费的表外资产”,而固定包月的“自助餐盘子”,只会越做越小。
历史的镜像:从云计算到“重置券经济学”
眼前发生的一切,对于经历过互联网基础设施演进的人来说,有一种强烈的既视感。
早在 2010 年代初,亚马逊 AWS 和各大云厂商刚刚普及云计算时,也经历过一模一样的阶段:一开始用极度便宜、甚至免费的套餐吸引开发者上云;等你的业务彻底跑在云上之后,再推出 CPU 突发积分(T2/T3 实例)、出站流量费、快照存储费等密密麻麻的账单项目。
现在的 AI 编程助手,正在重走一遍当年云厂商的“教育路线”。 只是这一次,学费是以社交媒体上的愤怒与争吵形式收取的。
在这场博弈中,甚至诞生了一种全新的产品词汇,Banked Reset(预存重置券)。

▲ Tibo 宣布预存重置已落地,这种机制已然成为一种“数字安抚通货”
在以往,如果系统故障,官方通常是全员重置计数器;而现在,OpenAI 把重置额度的权力包装成了一种可以存放在账户里、由用户自行决定何时启用的“数字权益卡”。
在里程碑庆祝时发一张,系统故障补偿时发一张,邀请好友再奖励一张。原本属于基础设施稳定性的问题,被巧妙地转化成了一种具有金融属性的“游戏道具”。
甚至在推特评论区里,用户们讨价还价的口吻也变了:从要求“把系统修好”,变为高呼“至少得赔我们 5 张 Banked Reset!”
终局:如何在这场算力大退潮中生存?
无论 OpenAI 的调查最终给出怎样的技术报告,一个不可逆转的现实已经摆在所有人面前:
大模型那个充满理想主义、花 20 块钱就能假装拥有全世界算力的“无限畅饮时代”,已经彻底终结了。
未来摆在开发者和普通用户面前的,是一个高度分层、颗粒度极细的精细化计算时代。面对这块越来越让人看不懂的“黑箱水表”,我们必须学会在新的游戏规则下生存:
- 告别“Sol 依赖症”,学会算力混搭
:在日常写样板代码、写测试用例、做格式转换时,果断切换到额度近乎无限的 Luna;只有在攻坚复杂算法、系统架构设计等生死关头,再唤醒昂贵的 Sol; - 警惕 Agent 的“隐形吞噬”
:在使用带有自动审查、多子代理协作的深度开发模式时,密切关注上下文长度。长会话中一次不经意的提问,消耗的可能就是几十次普通对话的额度; - 接受“按量付费”的必然宿命
:订阅包月制未来很可能只会沦为一种“保底门票”,高强度的生产力输出,终究要回到按 Token 每一分钱精确核算的云商业逻辑。
算力无法像自来水一样凭空涌出当模型进化的脚步越来越快,每一口甘冽的智能背后,都早已标好了越来越清晰的价码。
属于狂欢者的免费夜宴散场了,接下来,请握紧你的水表。

夜雨聆风