💀实锤:AI编程工具的额度就是一门糊涂账
官方文档写得明明白白:由我们自行决定
你每个月付 20 美元、100 美元甚至 200 美元买 AI 编程工具的会员,你以为自己买到的是固定算力。
没有任何一家大模型公司告诉过你,这个额度到底是多少 token。他们收钱的时候清清楚楚,给货的时候全是谜语。
这是全行业唯一一个卖你一个具体数量、但从头到尾不敢告诉你数量是多少的生意。
证据根本不用去黑产论坛找,Anthropic 官方帮助中心里就大摇大摆写着。在介绍 Max 套餐的页面上,官方对两档高价套餐的完整定义就两句话。
Max 5x 的定义是,每个会话的用量是 Pro 的五倍。Max 20x 的定义是,每个会话的用量是 Pro 的二十倍。
Pro 是多少?官方从不公布任何 token 数,也不公布任何消息数。
连小学生都知道,5 乘以一个没人告诉你的数,结果还是没人知道;20 乘以未知数,依然是个未知数。你每个月真金白银掏着高昂的订阅费,买到的不是具体额度,是一个连被乘数都没有的算式。
更绝的还在同一页的后半句。官方写明,为了管理容量并确保所有用户的公平使用,平台可能以其他方式限制你的用量,比如周度和月度上限,或者对模型和功能的使用限制,由我们自行决定。
由我们自行决定。英文原文写的是 at our discretion,这不是媒体卧底扒出来的黑幕,是你付款前就能在官网看到的霸王条款。
钱进了他们的账户,给多少水、什么时候停水、水管拧多大,全看他们今天心情。这吃相从第一天起就没打算藏着。
名字翻了四倍,官方数字一算只有 1.71 倍
有人可能会说,大模型调用按 token 算太复杂,官方给个大致区间已经算良心了。
行,那我们就来看 Anthropic 官方唯一一次给过的具体区间。
2025 年 7 月 28 日,TechCrunch 报道了 Anthropic 官方随周限额公布的一组数据。Pro 每周能用 40 到 80 小时 Sonnet 4;Max 5x 每周能用 140 到 280 小时 Sonnet 4、15 到 35 小时 Opus 4;Max 20x 每周能用 240 到 480 小时 Sonnet 4、24 到 40 小时 Opus 4。
把这组官方数据拿计算器按一遍,荒谬的地方立刻藏不住了。
第一个荒谬点,每一档的上限都正好是下限的两倍。40 到 80 小时,误差整整 100%。
你去饭馆点一份招牌牛肉面,菜单上写着面条重量在二两到四两之间,全看后厨心情,你不得把桌子掀了。到了软件行业,这居然成了官方公布的标准规格。
第二个荒谬点更扎心。从 Max 5x 升级到 Max 20x,套餐名字从 5 倍跳到 20 倍,字面上整整翻了 4 倍。月费从 100 美元涨到 200 美元,真金白银翻了 2 倍。
官方自己公布的周额度呢?Sonnet 额度下限是 240 除以 140,等于 1.71 倍;上限是 480 除以 280,还是 1.71 倍。Opus 额度更惨,下限 24 除以 15 只有 1.6 倍,上限 40 除以 35 甚至只有 1.14 倍。
花了两倍的钱,官方数字算出来最多只给 1.71 倍,套餐名字大言不惭叫 20x。这不是数学不好,这是把用户当傻子糊弄。
前几天国内 V2EX 论坛上有个热帖,有程序员发帖问,从 5x 升级到 20x,怎么感觉额度只有两倍多不到三倍。
不用怀疑自己的手感。你的手感完全正确,是那个印在套餐上的 20x 在公然撒谎。
额度缩水还怪用户,官方说是收回赠送
既然额度标准是一团浆糊,平台调起参数来自然毫无顾忌。
2025 年 7 月 28 日 Anthropic 刚宣布加装周限额的时候,官方信誓旦旦给出了两句承诺。一句是 Claude Code 遭遇了前所未有的需求,另一句是大多数用户不会察觉到差别,影响不到 5% 的订阅者。
事实很快就打了脸。2025 年年底,官方把额度翻倍当作假期礼物送给用户。到了 2026 年 1 月,假期结束,用户的额度直接断崖式崩塌。
The Register 在 2026 年 1 月 5 日的报道里记录了真实开发者的崩溃。有用户在社区抱怨,早上自己一行代码都没写,光是看了一下 markdown 文档,额度就直接见底了。
另一位用户反馈,自己用 Sonnet 写代码,稳定在 10 到 15 分钟内撞上限额,用量进度条直接飙到接近 100%。
一位匿名客户分析了自己的 Claude Code 运行日志,得出结论是 token 额度大约直接缩水了 60%。
面对铺天盖地的抗议,Anthropic 官方给出的解释简直让人气笑。官方声称这不是削减额度,只是把假期发放的赠送额度收回,回到了正常基线。官方代表甚至补充解释,说假期那批赠送额度用的是放假的企业客户闲置出来的算力。
翻译成人话就是,别人放假你才有饭吃,别人上班你就得饿着。企业客户一开工,个人开发者的额度就被连夜抽走。
到了 2026 年 3 月底,情况进一步恶化。在 Reddit 和 GitHub 上,大量 Max 订阅者反映 5 小时会话窗口在 1 到 2 小时内被耗尽,跑的还是以前一模一样的任务。一位 Max 20x 用户甚至发现,自己发了单条 prompt 之后,用量条直接从 21% 瞬移到了 100%。
Anthropic 官方人员随后在社区回应,为了应对需求增长,平台正在调整高峰时段的 5 小时会话限额。官方还很贴心地给出了建议,请把消耗 token 多的任务挪到非高峰时段去跑。
程序员白天上班干活,官方建议你半夜起来写代码。这已经不是服务好不好的问题,是完全不把付费用户的正常工作流当回事。
紧接着 4 月 1 日,devclass 报道 Anthropic 官方终于承认用户撞上限额的速度比预期快得多。有用户通过逆向分析声称找到了两个独立的 bug,会导致 prompt cache 失效,把成本在后台静默放大 10 到 20 倍。
虽然官方后来在 5 月把 5 小时限额翻倍,7 月又搞了限时提高周限额的促销,但这些动作全部发生在被全网骂穿之后。每一次所谓的让利,本质上都是在给之前的暗箱操作擦屁股,而那个最核心的 token 绝对值,直到今天依然一个字都不公布。
整个行业都在装瞎,谁也不比谁干净
如果只有 Anthropic 一家这么干,那叫个案。离谱的是,整个 AI 编程工具行业几乎都在玩同一套把戏。
来看 Cursor。2025 年 6 月 17 日,Cursor 宣布 Pro 套餐取消每月 500 次快速请求的硬限制,改成基于用量的 credit 模式,各大渠道铺天盖地宣传无限使用。
结果所谓的不限量全是一地鸡毛。所谓无限只适用于 Auto 模式,其他高级模型全被暗中扣费。社区里骂声一片,用户发现原本够用一整天的 Claude 4 额度被缩水到一小时,界面里的请求计数器甚至直接被官方移除了。
2025 年 7 月 4 日,Cursor 的 CEO 出来公开道歉,承认对个人套餐的定价改动没有清晰传达,团队承担全部责任,并开启了针对特定时间段内意外扣费的退款通道。
退款道歉看着挺体面,但改动从来没停过。现在的 Pro 套餐是每月 20 美元包含约 20 美元的用量额度,第三方按中位数估算大约够 225 次 Sonnet 请求或 550 次 Gemini 请求,但官方依然不给确定数字。光是 2026 年一年之内,Cursor 就改了三次计费方式,改到网上的评测文章全成了过期货。
再看微软家大业大的 GitHub Copilot。2025 年 6 月 18 日起,Copilot 开始对 premium request 计费,Pro 每月只给 300 次,超出部分一次收 0.04 美元。
原本包含在学生包里的福利被直接砍上一刀。社区讨论帖里,有用户在额度重置后 6 天就把 300 次用得干干净净,发帖大骂离谱。
至于 OpenAI 的 Codex,2026 年 4 月 2 日起把 Plus 和 Pro 套餐从按消息计费强行改成按 token 计费,7 月临时取消限制,8 月底又要下线旧模型替换新模型。规则变得比前端框架发版还频繁。
为什么全行业到今天都不肯公布每档套餐对应的真实 token 数?我的猜测是,一旦把具体数值公开写死,厂商就失去了随时根据算力成本在后台暗中拧阀门的特权,没法一边维持高毛利一边拿模糊规则当挡箭牌。把水搅浑,才能把利润最大化留给自己。
代码明明是这世界上逻辑最严密的东西,给写代码的人用的工具,却偏偏建立在全行业最不透明的黑盒计费上。一边收着高额订阅费,一边在后台随意滑动手里的限流阀门,被抓包了就甩锅给算力紧张或系统 bug。明知故犯还狡辩,这才是最无耻的地方。
只要他们一天不把每档套餐对应的真实 token 标在明处,你买到的所谓生产力工具,就永远只是一张随时可能被单方面改写规则的空头支票。
夜雨聆风