

谁也没有想到,一场席卷全球开发者社区的信任风暴,会在毫无预警的平静中突然爆发。
2026年8月下旬的一个深夜,无数正通宵赶工的程序员,在终端屏幕前被同一行冰冷的红色报错硬生生逼停,“周使用额度已耗尽(0% remaining)”。

▲ 开发者发帖称:Pro 计划额度在一天之内从 100% 耗到见底,配图可见当时仅余 6%
这名用户称,整个过程仅仅用了一天
这份按周重置的高级订阅配额,在短短 24 小时内几乎消耗殆尽。从 Reddit 到 X(原推特),再到 OpenAI 官方开发者论坛,愤怒的抗议声瞬间如滚雪球般炸开。
几位硬核程序员甚至搬出了专门自研的本地流量监测雷达,直接读取本地日志并估算出了一个令人瞠目结舌的结果:部分样本的周额度 API 等价值,似乎下降了 50% 到 77%!
这究竟是算力吃紧下的“秘密暗砍”,还是一场由超级模型失控引发的技术悬案?
疯狂的“免费盛宴”:一个月吃掉一万四千美元?
要看懂这场地震,我们得先厘清一个底层概念:Codex 到底是什么?
它随 ChatGPT Plus、Pro 等订阅计划提供,是一款编程代理(Agent)。你买了每月 20 美元的 Plus,或者 100 到 200 美元的 Pro,就能在后台驱动代码模型,替你写代码、查 Bug、自动跑测试。

▲ 社区流传的量化数据:Plus 与 Pro 计划的等价周额度出现 50% 至 77% 的惊人跌幅
长期以来,这被称为 AI 领域最不可思议的“全天候自助餐”。
在 2026 年 6 月,硅谷知名半导体分析机构 SemiAnalysis 曾做过一次极其硬核的实测:他们用长程编码任务把各类订阅打满,然后按照 OpenAI 官方 API 的公开单价去反推,这些包月用户到底薅走了多少算力?
测算出来的数字把整个行业都吓了一跳:
- 20 美元/月的 ChatGPT Plus
:极限情况下能烧掉价值约 700 美元的 API 算力; - 100 美元/月的 Pro (5x)
:等价于约 3,500 美元的 API 算力; - 200 美元/月的 Pro (20x)
:更是夸张地冲到了 14,000 美元(约合人民币 10 万元)的惊人峰值!
这相当于你花了一张经济舱的机票钱,OpenAI 却直接给你包了一架波音 747。所有人都心知肚明:这是巨头在用真金白银的算力亏损,强行补贴开发者的工作习惯。
然而,自助餐总有收摊的一天8 月中旬开始,这场狂欢戛然而止
民间雷达对线:从 160 刀跌到 80 刀的“腰斩线”
最先拉响防空警报的,是开发者自建的本地监控工具 NerfTrack。
由于 OpenAI 官方仪表盘极度模糊,只给一个百分比进度条和滚动的五小时窗口,根本不显示具体消耗了多少 Token。于是,这群极客写了一个本地桌面程序,直接读取本地的日志事件,把每一批 Token 按照 API 价格实时换算,再根据官方百分比的反向推导,逆向计算出官方“暗中给定的周总预算”。

▲ 开发者 Deepu 整理的数据对比:从早期的巨额补贴到如今腰斩式缩水,并公开质问官方负责人
监测曲线出来的那一刻,整个社区炸锅了:
- Plus 用户
:原本折合每周约 160 美元的 API 等价额度,在几天之内直线坠落到约 80 美元,降幅整整 50%; - Pro 5x 用户
:更是从每周约 674 美元暴跌到 157 美元,缩水幅度高达 77%!
“同一种订阅,少得多的 Codex”愤怒的用户在社交网络上转发这些趋势图。人们纷纷猜测:OpenAI 或许扛不住算力暴增,开始悄悄压缩老用户的可用量?
但真相远比单纯的“暗砍”更加诡谲几乎在同一时间,另一个监控工具 TiboTattle 却给出了完全不同的数据:在他们的样本库里,Pro 20x 的周额度依然稳定在每周 2,000 美元以上,并没有出现全员一致的断崖下跌。
两款工具各执一词,官方黑盒深不可测。这场迷局迅速演变成了一场技术罗生门。
官方紧急应战:“异常与反欺诈有关,额度调整会保持透明”
舆论彻底沸腾后,OpenAI 的 Codex 核心负责人 Tibo Sottiaux 终于坐不住了。8 月 21 日,他在 X 上公开发文回应,试图给这场恐慌灭火。

▲ OpenAI 负责人 Tibo 做出官方澄清:绝不会暗中削减额度,并指出部分异常源于对 sub2api 等转售行为的反欺诈打击
Tibo 明确给出了三点定调:
- 绝无暗箱操作
:OpenAI 不会偷偷摸摸地修改订阅计划的基础用量; - 正在重拳反欺诈
:调查发现,大量反馈额度异常的账号,都在违规使用名为 sub2api 的工具,也就是把个人的 ChatGPT 订阅流量包装成 API 接口,私下转售或者多端共享,这类行为已被风控系统精准标记拦截; - 正规客户端无恙
:只要是通过官方登录或合规开源客户端使用的用户,机制完全正常。
然而,这套“抓内鬼”的说辞并没能平息民愤。

▲ 开发者 James 激烈反驳:自己全程只用官方 ChatGPT App,但额度依然从 7 天缩水到 1 天
推文下方很快出现反驳有人称自己只使用官方 Mac 桌面端写代码,过去能撑 7 天的额度如今 1 天就见底。
官方否认砍基础额度,普通开发者也声称自己未曾违规倒卖,那凭空蒸发的天量算力,究竟去哪儿了?
另一种解释:AI 变成了“吞金兽”
将所有公开线索与代码逻辑放在一起看,还存在另一种技术解释:额度的池子或许没有明着缩水,池子里的水却被新一代模型以惊人的速度抽干了。这只是公开材料能支持的可能性之一,尚不足以证明所有账号都经历了同一种变化。
这里的核心变量,正是 OpenAI 寄予厚望的全新王牌模型:GPT-5.6 Sol。
1. 致命的“勤奋”:子代理在后台疯狂自转
早期的代码助手像个听话的打字员,你问一句,它答一段。但到了 GPT-5.6 Sol 这一代,它彻底进化成了一个“全自主 Agent”。
当你轻描淡写地在对话框输入一行指令:“帮我重构这个登录模块并跑通测试。”表面上看你只发了一条消息,但在你看不到的后台,Sol 已经悄悄分裂出了数个子代理(subagents):
子代理 A 负责通读你的整个工程目录(吞掉数十万上下文 Token); 子代理 B 尝试写代码并调用本地终端反复编译; 编译报错后,子代理 C 自动轮询修正,甚至在后台连续跑了十几轮静默测试。
这种“极度肯干”的代价,是 Token 消耗量的指数级爆炸。正如 Tibo 在 7 月底的技术说明中所坦承的那样:Sol 的推理深度和多工具调用极其激进。原本看似普通的单次交互,在后台烧掉的算力可能是前代模型的数倍甚至数十倍!
2. 上下文收紧与轮询 Bug 的“暗中背刺”
雪上加霜的是,近期有技术媒体曝光,新模型的默认上下文窗口策略有所收紧。当开发者面对大型项目时,更容易触发系统的自动上下文压缩、重试与摘要机制。
更有开发者在排查中发现,某些客户端在执行长命令时存在高频轮询 Bug:命令挂起期间,每一轮轮询都在重复发送数以千万计的巨幅历史上下文。你的代码一行没改,后台的计时器却在一刻不停地狂烧额度。
3. 促销红利消退的“心理落差”
别忘了,在 2026 年上半年,OpenAI 为了推广 Codex,曾连续放出过多项隐形福利:双倍速率限制活动、邀请好友赠送的额度重置卡、甚至在 7 月中旬为了排查问题临时拆掉了五小时限制墙。
当这些“狂欢期特殊红利”在 8 月被悄然收回、五小时与每周硬限制重新咬合时,用户体感上的落差,瞬间化作了“额度被腰斩”的强烈被剥夺感。
不可预期的“黑盒”,正在消耗开发者的信任
这场 Codex 配额大地震,给整个 AI 行业上了一堂无比深刻的商业课。
对于每天依赖 AI 编写核心业务的工程师而言,“不可预期”带来的恐惧甚至超过了涨价。
如果一个工具本周能撑满 5 个工作日,下周却在周二下午突然暴毙,没有任何一个正规工程团队敢把核心业务建立在这样不透明的流沙之上。当官方拒绝给出清晰可核验的 Token 明细账,只留下一个飘忽不定的百分比进度条时,就怨不得社区自建“民间雷达”,把每一次体验滑坡都解读为巨头的算计。
随着 Claude Code 等强力竞品的步步紧逼,属于 AI 编程助手的“无限补贴大乱斗时代”正在加速终结。
未来的竞争,不再仅仅是比拼谁的模型更聪明,更是比拼谁能给开发者提供一份透明、稳定、值得托付身家的确定性。 毕竟,代码可以重构,但失去的信任,往往无法通过一次“重置限额”轻易挽回。

夜雨聆风