

你敢相信吗?在刚刚过去的几个夜晚里,全球成千上万名顶级程序员,正经历着一场前所未有的“赛博断粮危机”。
试想这样一个场景:你是一家科技公司的核心架构师,每个月向 OpenAI 支付着数百美元的高级订阅费。深夜,你泡好一杯咖啡,信心满满地给 AI 编程助手下达了重构代码的指令,准备美美睡上一觉,等天亮验收成果。
然而第二天清晨,当你推开电脑屏幕,只看到一行冰冷的红色警告:你的整周使用配额已彻底归零。

▲ OpenAI 开发者社区高楼求助帖:周额度掉得太快,究竟是Bug还是暗改?
类似抱怨很快在开发者圈子里成片出现。有人在社交平台上崩溃发帖:“我买的是 5 倍高阶套餐,离下周刷新还有整整 4 天,额度竟然只剩 11% 了!这根本不符合常理,OpenAI 绝对暗中动了手脚!”
回头看,这场大崩溃的源头,竟然始于一个月前 OpenAI 官方主动送上门的一份“泼天大礼”。
从人人欢呼的“取消限制”,到如今全网哀鸿遍野的“额度杀猪盘”,OpenAI 究竟在这个夏天对全球开发者做了什么?
狂欢的开端:一场被包装成“史诗级福利”的松绑
要把这起事件讲透,我们必须先用大白话,拆解一下 OpenAI 旗下编程产品 Codex 的两道“紧箍咒”。
在过去,订阅了 OpenAI 服务的开发者,头顶上悬着两把尺子:
- 第一把尺子叫“5 小时短期闸门”
:系统每 5 个小时算一次账,防止你短时间内高频轰炸服务器; - 第二把尺子叫“周限额(Weekly Limit)”
:无论你怎么分配,每 7 天的总使用量有一个封顶上限。
对没日没夜赶进度的程序员来说,最痛苦的莫过于每干几小时就撞一次“5 小时南墙”,思路被硬生生掐断。
转折点发生在 2026 年 7 月中旬
OpenAI 的产品负责人蒂博(Thibault “Tibo” Sottiaux)在社交平台 X 上毫无预警地连发重磅推文,向全球开发者宣布了一则特大喜讯:官方决定暂时拿掉 Plus、Business 和 Pro 用户的“5 小时短期限制”!

▲ Tibo 宣布暂时移除 5 小时限制,并伴随用户里程碑发放免费重置
不仅如此,Tibo 还化身成了慷慨的“赛博圣诞老人”。伴随着 Codex 活跃用户突破 600 万、1000 万、1500 万的里程碑,他频繁在 X 上全网发放“免费额度重置(Reset)”。
那是一段堪称蜜月期的日子开发者们在推特上狂欢,纷纷夸赞 OpenAI“终于把用户当成年人看待了”,大家不用再掐着表算 5 小时倒计时,想什么时候集中爆肝就什么时候爆肝。
然而,在这片狂欢的海洋中,只有极少数敏锐的技术老手,死死盯住了官方声明里的那个单词,Temporarily(暂时的)。

▲ 开发者 Mark Kretschmann 敏锐指出:天下没有免费的午餐,注意“暂时”二字
天下真有免费的午餐吗?短期闸门被悄悄推倒后,人们期待的算力自由并未出现,迎面而来的却像是一张早已织好的捕兽网。
宿醉与崩盘:一夜之间,整周的“口粮”全被抽干!
狂欢的泡沫,在 8 月中旬彻底破裂
随着官方发放“免费重置”的频率放缓,程序员们猛然发现,原本看似宽裕的“周限额”,变成了一堵坚不可摧的铁壁。

▲ 开发者早在 7 月底便发出预警:免费重置会不会只是转移注意力的障眼法?
知名独立开发者 OrcDev 在 X 上转发了一篇控诉帖,并写下了一段引发全网震动的证词:
“OpenAI 绝对暗中大砍了配额。现在你只需要跑几个 High 甚至 Extra High 强度的智能体任务,一夜之间就能烧光一整周的配额! 要知道在以前,哪怕开着一堆顶级的 GPT-5.6 Sol Ultra 疯狂跑,也根本不可能耗得这么快。”

▲ 用户愤怒直言:取消 5 小时限制后,周可用量感觉少了 3 倍
一石激起千层浪无数原本以为是自己“代码写太多”的开发者,纷纷晒出惨痛的后台截图:
“购买了 Pro 5x 套餐,还有 4 天才刷新,额度就掉到了 11%,这在我的使用历史上从未发生过!” “取消 5 小时限制后,现在的周额度体感上比以前缩水了整整 3 倍,根本没法正常干活!” “以前五天都烧不完的量,现在一天就直接见底。”
如果把订阅 OpenAI 比作去吃自助餐:过去店员每隔 5 小时提醒你一次“少吃点”,虽然烦人,但你至少知道这周天天有饭吃;现在店员把门口的打卡机拆了,热情地招呼你随便吃,结果你刚吃了两口,店员突然把整张餐桌端走,微笑着告诉你:“对不起,你本周的卡路里份额已经耗尽,请下周再来,或者加钱买单。”
连环套猜想:从“免费蜜糖”到“付费DLC”
面对这诡异的现象,开发者社区里迅速形成了一个逻辑严密的“三步连环套”假说。
开发者 macintog 用极具讽刺意味的笔触,将整场风波还原为 OpenAI 的一场精妙控盘:
- 第一步:拆掉小闸门,掩盖真实消耗。
随着高推理模型普及,任务本身越来越吃算力。如果保留 5 小时限制,所有人都会疯狂撞墙投诉。于是官方干脆拿掉 5 小时限制,把算力消耗的压力全推给下游。 - 第二步:狂发免费重置,制造繁荣幻觉。
当大家开始在不知不觉中以惊人速度透支周配额时,官方借着“庆祝千万用户”的名义,像撒糖果一样疯狂发放免费重置。用户只觉得额度永远用不完,却忽略了底层的消耗基准早已发生剧变。 - 第三步:糖果收回,付费“DLC”登场。
当免费重置活动突然刹车,所有人的真实工作流早已被高强度模型绑架。习惯了奢华算力的开发者瞬间撞上周限额硬墙,走投无路之下,唯一的选择就是掏出信用卡:购买额外积分(Credits),或者升级更昂贵的套餐。
这套“从免费试吃引流,到暗中加速消耗,再到付费买命”的商业推演,迅速在技术圈内激起了巨大共鸣。
面对漫天质疑,OpenAI 官方员工 Vaibhav(@reach_vb)紧急现身评论区灭火,措辞严厉地呼吁大家“停止散布不实信息”,并要求感到异常的用户提供具体的反馈 ID 与前后数据对比,以便官方排查。

▲ OpenAI 员工 Vaibhav 驳斥暗改传闻,要求用户提供审计证据
然而,这种个案维权式的回应,并没有平息公众的怒火。用户最在意的,是整个 AI 订阅制底层难以看透的黑盒。
算力黑盒:为什么“百分比仪表盘”正在摧毁信任?
为什么开发者会如此愤怒?要理解这种信任危机,我们需要看清传统云服务与生成式 AI 之间的一道鸿沟。
在传统的云计算时代,计费是极其透明的。你租了一台服务器,跑了多少内存,用了多少度电,读了多少次硬盘,账单上写得明明白白,精确到小数点后四位。
但在今天的 AI 编程世界里,OpenAI 给用户看的,只有一个极度模糊的“百分比进度条”。

▲ OpenAI 官方费率表:模型每一次复杂推理与调用都在暗中计价
这个百分比背后隐藏着巨大的认知黑洞:
1. 智能体(Agent)成了吞噬算力的“隐形巨兽”很多非技术读者以为,AI 编程就像在微信里聊天,你发一句它回一句。如今最顶级的编程模型(如 GPT-5.6 Sol)接到一个重构任务时,会在后台反复推理、自动分工、查阅成千上万行代码,甚至自我测试纠错。你表面上只下达了一条指令,后台可能已经完成了数十次交互,吃掉了数百万个 Token。
2. 共享额度池的“静默分流”根据官方文档,Codex 与 ChatGPT Work、Excel 智能体等功能,在很多套餐下是共享同一个额度池的。你在表格工具里点了几下自动化分析,回过头来,Codex 编程界面的周额度就已经被扣掉了一大截。用户只觉得“我今天没写几行代码”,却不知道背后的总蓄水池早已被其他管道抽干。
3. 不可审计的“绝对值”当仪表盘只显示“你的配额还剩 20%”时,没有任何人知道这 20% 到底代表多少计算资源。上周的 100% 和这周的 100% 能否等量比较?当官方缺乏透明的审计日志,哪怕只是模型策略的一次微小调整,投射在用户端,都会被无限放大为“资本家在后台偷偷拧紧了龙头”。
这种用不可预期的百分比去管理专业工程师工作流的做法,从一开始就埋下了信任崩塌的引信。
商业真相:无限算力的营销狂想,终究撞上了物理现实
退一步看,这场围绕“周限额”的拉锯战,本质上是整个生成式 AI 行业不得不面对的一场残酷成年礼。
过去几年,所有大模型厂商都在不遗余力地向公众推销一个美丽的童话:只要你每月付一笔固定的会员费,就能把一个无所不知、不知疲倦的数字劳工请回家。
但商业的底层物理法则从未改变,算力是有成本的,每一度电、每一张显卡的折旧,都必须有人买单。
在 OpenAI 官方此前发布的工程技术博客《Beyond rate limits》中,工程师们曾坦诚地写道:纯粹靠固定速率限制,满足不了深度需求;而纯粹按量计费,又会吓退早期的探索者。
然而,当智能体(Agent)技术从“玩具”进化为能够接管复杂工程的“生产力工具”时,算力的边际消耗呈指数级暴涨。一个重度开发者一天所消耗的推理算力成本,可能远远超过他所支付的几十美元月费。
“包月无限量”的营销幻象,终于撞上了算力成本的物理钢铁之墙。
于是,我们看到了这荒诞的一幕:官方既想维持平价订阅的表面吸引力,又不得不通过各种隐蔽的闸门与复杂的费率表来控制失血速度;而用户在经历了免费派送的“甜蜜狂欢”后,一旦基线回归常态,便感受到了被背刺的巨大落差。
如今,技术社区里已经开始掀起新的反思风潮:有人开始把轻量任务分流给本地运行的开源小模型,只在关键时刻调用昂贵的云端大脑;有人干脆彻底抛弃黑盒订阅,转而使用按实际 Token 计费的底层 API,只为买一个明明白白。
这场盛夏里的“限额风波”,或许只是一个开端。它清晰地提醒着所有人:AI 狂飙突进的免费蜜月期已经结束,一个精打细算、锱铢必较的真实商业世界,正在加速向我们走来。

夜雨聆风