

全球程序员的周一清晨,被一场突如其来的“算力大崩塌”彻底砸醒了。
“付了最贵的Pro订阅,配额以前能爽用整整一周,现在一到两天直接见底。”“同样改几行代码,以前进度条纹丝不动,现在半小时暴跌13%!”在推特与开发者论坛上,哀嚎与愤怒像野火一样蔓延。有人绝望地发帖宣告:“Codex已经死了。”

▲ 社区大V转发爆料:OpenAI疑似在未发公告的情况下将额度砍半
更可怕的锤炼来自民间的“测谎仪”一款名为 NerfTrack 的本地监测工具,读取本机日志后给出了一个令人倒吸凉气的估算:部分用户的监测结果显示,ChatGPT Plus 周额度按官方 API 市价折算,可能从约 160 美元降到了 80 美元;社区转述的 Pro 5x 等值额度则从 674 美元降至 157 美元,估算跌幅高达 77%!
花同样的钱,买到的算力却缩水了一大半?全球开发者被激怒了:OpenAI 是否在背地里调整额度,搞无预警的暗度陈仓?
尺子打架:160美元腰斩,是真相还是幻觉?
要搞清楚这场海啸,先得明白程序员们到底在用什么。
OpenAI 的 Codex 随 ChatGPT Plus(每月 20 美元)或 Pro(每月 100 到 200 美元)订阅提供,是一款顶级编程代理(Agent)。它能直接读取代码仓库、执行终端命令、开子代理并发查错,也能进行对话。
但诡异的是,OpenAI 从来不告诉用户你这周到底能消耗多少 token、值多少美元。在客户端里,你看到的只有一根极度简陋的百分比进度条。

▲ 社区疯传的 NerfTrack 监控面板:Plus 周等值额度疑似从 160 美元跌至 80 美元
既然官方玩“黑盒”,社区只能自己造尺子。
NerfTrack 的原理很简单:它在本地读取 Codex 运行产生的日志,把消耗的所有输入、输出 token 按照 OpenAI 的公开 API 价目表算成美元,再除以你这一段时间消耗的百分比,反推官方给你的“周额度总盘子到底值多少钱”。
公式一跑,震惊全网的“腰斩”数字出炉了。
然而,抓马的事情马上发生:另一位开发者掏出了另一把尺子,TiboTattle。这个追踪器测出的结果却大相径庭:Pro 20x 用户的周额度折合 API 市价依然高达 2043 美元,最近几天根本没看到什么断崖式暴跌!

▲ 另一款追踪器 TiboTattle 显示未见显著下调,两家工具作者决定联手建库
两把尺子当场打架是 NerfTrack 测错了,还是 TiboTattle 样本太少?其实,两套工具都没完全说谎NerfTrack 的致命短板在于,如果用户在云端任务、网页端或者其他设备上也用了 Codex,但本地日志没记下来,分母一旦被稀释,算出来的等值额度就会瞬间“腰斩”。
但对于每天守在电脑前敲代码的普通人来说,“额度不够用、干活频频撞墙”的窒息感,却是百分之百真实的。
官方灭火:送你一颗“后悔药”,顺便扣上一顶大帽子
随着民怨沸腾,8 月 21 日,OpenAI 负责 Codex 与 ChatGPT 产品的关键先生,Thibault “Tibo” Sottiaux(@thsottiaux)终于坐不住了,连发推文表态。
但他这番回应,不仅没能扑灭大火,反而像往滚油里泼了一瓢冷水。

▲ Tibo 发文宣布活跃用户破 2000 万,并向付费用户发放一次自选重置(BANKED reset)
Tibo 先是扔出了一颗糖果:宣布 Codex 周活跃用户已经冲破 2000 万大关!为了庆祝,OpenAI 将给所有 Codex 和 ChatGPT Work 付费用户发放一次“存档式重置包”(BANKED reset),当你额度用光时,可以像在游戏里喝血瓶一样,随时手动满血复活一次。
紧接着,他对“额度缩水”做出了定性:
- OpenAI 绝不会在不沟通、不透明的情况下偷偷削减用户额度;
内部排查发现,部分受影响案例在用第三方工具(如 sub2api)把订阅套餐转成 API 再转售或多人共享,这类用法会触发系统的防欺诈风控; 官方正在严肃调查消耗过快的问题,目前“并未发现全局异常”。
这段解释一出,推特评论区瞬间被愤怒的开发者攻陷。

▲ 有开发者愤怒回复,认为官方把正常付费用户也指为欺诈者
“我一个人用官方原生客户端,既没开外挂也没搞转售,额度从撑 7 天变成撑 1 天,你现在说我是黑产欺诈犯?”“合着我们交了钱的忠实用户,在你们眼里全是倒卖算力的骗子?”
一次本该展现技术诚意的沟通,硬生生演变成了一场信任崩塌的公关车祸。
拆解黑盒:那根绿色的百分比条,到底吞掉了什么?
抛开情绪的喧嚣,一个关键的技术谜题浮出水面:如果官方真的没改总额度,为什么大家手里的配额就是用得飞快?
答案,藏在现代 AI 编程代理那深不见底的“算力吞吐逻辑”里。

▲ OpenAI 官方文档显示:只明确了 5 小时滚动区间的本地消息数,周限额始终是未公开的灰箱
1. 5小时闸门消失带来的“暴食错觉”
在过去的机制中,OpenAI 设置了极度严格的“5小时滚动窗口”。这就像家长每5小时给你发一笔零花钱,虽然憋屈,但强迫你细水长流。而在部分用户所称的5小时短窗弱化阶段,周限额成了主要闸门,机制近似“周一直接发你一周的工资”。许多重度开发者在不知不觉中激进调用,一两天就把整周的算力挥霍殆尽,剩下五天只能在干旱中痛苦煎熬。
2. 代理式 AI(Agentic AI)的“算力黑洞”
今天的 Codex 已经从“你敲一行我补一行”的单轮模型走向代理式工作流。当最新的 GPT-5.6 Sol 启动时,它在后台做的事情超乎普通人的想象:
复杂任务可能拉起多个子代理(Subagents)并行测试; 每次写完代码,会自动触发多轮自我审查(Auto-Review); 如果你开了 Fast 模式或者配置了 MCP 服务器,系统在后台为了追求极速和深度,会以数倍的推理强度(Inference Compute)疯狂燃烧 Token。
一句“改一个按钮颜色”的指令,也可能让它反复读取大量代码上下文,并在虚拟沙盒里执行多轮测试。 你的任务看起来只花了一秒钟,后台的算力账单却已经烧穿了天花板。
乞求式重置:大模型时代的“自助餐危机”
在这场风波的背后,一个名为 Codex Resets 的网站悄然走红。
这个由民间极客搭建的网站,甚至没有复杂的分析,只做一件事:像记录自然灾害一样,实时打卡 OpenAI 官方给全网重置额度的历史记录。

▲ 民间搭建的 codex-resets.com 仪表盘,忠实记录着历次全网“回血”的惨烈节奏
从历史数据看,官方的“全员重置”频率高得惊人:6 月因为自动审查死循环 bug 搞过紧急 War Room,7 月因为 Sol 模型太耗算力又做过优化降压……每一次系统算力吃紧、用户怨声载道时,官方的标准动作几乎如出一辙:修个补丁,然后全服发放一次额度重置。
这催生了一种极其荒诞的“数字斯德哥尔摩综合征”:用户买的本是一份白纸黑字的商业合同,最终却演变成一种“求神赐福”的畸形关系,用完就骂,骂完等 Tibo 发重置,重置完接着用,用光了再继续骂。
这恰恰撕开了生成式 AI 商业模式最残酷的遮羞布:订阅制的“自助餐逻辑”,正在与高昂的“算力物理学”发生不可调和的正面撞击。
- 在用户看来
:我每个月真金白银掏了 20 美元甚至 200 美元,我买的就是无限畅饮的“自来水”; - 在厂商看来
:大模型的推理成本是实打实的电力与 GPU 折旧,我卖给你的只是一篮子弹性算力; - 在黑产与套利者看来
:只要 20 美元的订阅能跑出 200 美元的 API 等值算力,我就有一千种办法把你的池子抽干。
当厂商用防欺诈风控和动态计量来对冲成本时,只能看到绿色百分比条、看不到分项账单的普通用户,就承担了这场拉锯战中的不确定性。
独立调查机构 Kingy AI 对整起事件给出的判决极具穿透力:“SUPPORTED BUT UNPROVEN”(报告真实可信,但全网暗砍证据不足)。
是的,也许 OpenAI 确实没有在后台一刀切地把额度系数改成 0.5。但当产品的计量越来越像黑箱、当用户的合理消耗动辄被扣上欺诈的帽子、当唯一的补救措施是一次性的“回血药水”时,
这场争议消耗了几个百分点的算力,也透支着核心开发者曾经毫无保留交付的信任。

夜雨聆风