乐于分享
好东西不私藏

为什么 “ AI 服务订阅制 ” 注定会走向消亡?

为什么 “ AI 服务订阅制 ” 注定会走向消亡?
6 月 9 日,Anthropic 发布了它迄今最强的公开模型 Claude Fable 5。

按照惯例,这应该是付费用户的节日,每个月交的钱终于换来了第一时间摸到旗舰的资格。但公告里有一行字,在发布后立即引发了巨大的争议:6 月 22 日之后,Fable 5 将从所有订阅计划中移除,继续使用需要单独购买用量积分。

换句话说,即使你买了会员,旗舰模型也只让你用 14 天。

一个模型在发布当天就自带“逐客令”,这在大模型行业还是头一回。

很多人把它当成 Anthropic 的一次失误,或者一次傲慢。但事实上,这根本不是什么失误,而是一场精准到令人窒息的预告。订阅制的丧钟,正在被整个行业联手敲响。

一、14 天,是警告也是信号

先把事实摆清楚,按照 Anthropic 的官方安排(2026 年 6 月 9 日),Fable 5 从发布日起免费包含在 Pro、Max、Team 和按席位计费的企业版里,截至 6 月 22 日。6 月 23 日起,它会被从这些计划中拿掉,之后的每一个 token 都要从预付的用量积分里扣,费率与 API 完全一致。

这个费率不便宜。每百万输入 token 10 美元、输出 50 美元,恰好是上一代旗舰 Opus 4.8 的两倍。更微妙的是,即便在免费窗口期内Fable 5 在订阅额度里也按大约两倍的权重计算。同样的活儿,烧额度的速度是 Opus 的两倍。

用户炸了。

Hacker News 上有人直言这种“先给再收”的操作令人不安,怀疑 Anthropic 是想借机把订阅用户推向按量计费。开发者实测发现在每月 100 美元的 Max 计划上,一次 agent 编程会话就消耗了价值近百美元的 token。

但这不是 Anthropic 一家的动作,过去八周,整个行业都在做同一件事。

二、八周,三巨头,一份答卷

八周内,三巨头同时转向按量计费

4 月 2 日 OpenAI Codex 对齐 API Token 计费

4 月 4 日 Anthropic 限制第三方 Agent 消耗订阅额度

4 月 20 日 GitHub Copilot 转向 AI Credits

5 月 14 日 Anthropic Agent SDK 移出订阅池

时间线拉出来,就知道这不是巧合。

4 月 2 日,OpenAI 把 Codex 从按消息计费改成对齐 API 的按 token 计费,随后扩展到全部存量企业客户。

4 月 4 日,Anthropic 禁止 OpenClaw 等第三方 agent 框架消耗订阅额度,这类用法改走按量付费。这意味着,过去那种“一月几百块、AI 随便用”的日子,在 Claude 这里正式结束了。

4 月 20 日,GitHub 冻结 Copilot 个人版新注册,一周后宣布全线转向 AI Credits 计费,6 月 1 日切换完成,Pro 档 10 美元月费,附带的就是 10 美元积分。

5 月 14 日,Anthropic 正式宣布,6 月 15 日起 Agent SDK 和无界面调用移出订阅池,改为按 API 费率计量的独立积分。

三家公司,八周,同一个方向这不是巧合,是整个行业在同一道数学题面前交出了同一份答案。

三、那道数学题到底长什么样?

研究机构 SemiAnalysis 最近把这道数学题摆上了台面。他们把 Anthropic 和 OpenAI 的每一档订阅各买了一份,跑长程编程任务,一直跑到把每周限额耗尽,再按 API 牌价折算这些用量值多少钱。

此前业内的普遍认知是一个每月 200 美元的套餐,最多能跑出约 2000 美元的 token。实测结果远超于此,20 美元的 Claude Pro,用满额度相当于消耗了约 400 美元的 API 用量;200 美元的 Max 计划,实际能跑出的价值更是惊人。

有位开发者晒出了自己的账单:Max 计划一个月 200 美元,用深度推理模式跑了几次代码重构任务,月底一看,消耗的 token 按 API 计价超过了 2000 美元。平台每收 1 美元,要付出去 10 美元的成本

这道题放在数学上就是收入固定,成本浮动。重度用户用得多,平台亏得多。轻度用户用得少,也觉得替人买单。重度用户还被各种限速、降智、额度耗尽打断,满腹委屈。

四、这不是成本问题,是模式问题

2025 年 8 月,Anthropic 悄悄给订阅制加了每周使用上限。当时很多用户发现,每周限额在工作周结束之前就已经耗尽,他们付了 200 美元的 Max 20x,结果却经常被挡在门外。

紧接着是“静默调价”。

2026 年 4 月,Anthropic 发布 Claude Opus 4.7,公告里有一行不起眼的小字:新模型采用了全新的分词器,“相同文本最多消耗 35% 更多的 Token”。但 Opus 4.7 和 4.6 的定价完全一致,输入 $5/百万 Token,输出 $25/百万 Token。

这意味着,你没多花钱,平台也没涨价。但相同的工作量,需要的 Token 多了将近一半,你的月费能买到的 AI 服务凭空缩水了 30% 以上。

开发者不是傻子。很多人开始认真记账,在 Reddit 发帖互相核对账单。越来越多人发现:Claude 在变贵,而且变贵的方式不在明面上,而是藏在每一次模型更新和产品发布的细节里。

五、豆包的商业化阵痛,是同一个故事的国内版

故事的国内版本,也在同一时间上演。

2026 年 5 月 4 日,字节跳动旗下 AI 助手“豆包”悄然更新付费版本服务声明,披露三档付费方案:标准版连续包月 68 元、加强版 200 元、专业版 500 元,包年价格最高达 5088 元。

结果呢?据全球人工智能市场追踪机构 Aicpb.com 数据显示,豆包 5 月的月活跃用户环比下降 1.81%,流失约 607 万用户。这一动作被大量普通用户解读为“即将全面收费”,引发恐慌性卸载。字节跳动过早推进商业化,可能使其在竞争激烈的消费 AI 市场失去领先地位。

但字节跳动的困境是整个行业“被逼着收费”的缩影。用户越多,算力成本越高。免费用户太多,重度用户把成本吃空。收费了用户就跑,不收费就亏损。

RevenueCat 发布的《2026 年订阅应用现状报告》证实了这一困境:AI 应用的中位年度订阅流失率比非 AI 应用高出 30%,月度留存率为 6.1%,而非 AI 应用是 9.5%。

这是一个“怎么选都是错”的局面,不是因为产品不够好,而是从一开始就用错了模式。

六、AI 不是软件,AI 是“用电”

订阅制在软件行业成立,前提是边际成本趋近于零。你做了一套笔记软件,多一个人用,平台几乎不花额外的钱。

但 AI 不是这样。你每问 AI 一句话,背后都是 GPU 在转、电费在烧、Token 在消耗。

有的人一天问几句,有的人拿它跑项目、写代码、做方案,一聊就是几个小时。前者和后者交的月费是一样的,但平台付出的算力成本可能相差几十倍甚至上百倍。

这就尴尬了,轻度用户觉得自己的钱亏了:别人用得比我狠,凭什么付一样的钱?重度用户觉得委屈:我是真爱粉,怎么反而被限得最狠?平台觉得撑不住:再这样下去,我要亏死。

正如 OpenAI ChatGPT 负责人 Nick Turley 在近期访谈中直言:“在当前这个时代,提供无限量套餐,可能就像提供无限量用电套餐。”

你见过“包月用电”吗?没有。因为如果包月,重度用户会把电网用垮。AI 也是一样的道理。

七、Agent 时代,这道题更难算了

如果说 token 消耗量的差距是几百倍,那 AI Agent 的降临直接把差距拉到了几千倍。

为什么?因为 Agent 不是“人聊天”。Agent 可以自动执行多步任务,查数据、调 API、跑程序等等。一次 agent 任务的 token 消耗,是普通对话的 5 到 30 倍。而且 Agent 的消耗不需要人类时刻在场它可以在云端 24 小时不间断运行,像一台永不停歇的机器一样消耗算力。

这正传统订阅制赖以存在的另一个根基“人类有生理上限”被彻底推翻的时刻。以前看剧再狠一天也只能看 24 小时。现在 AI 可以自己跑通宵。

SemiAnalysis 测算过一个真实场景:一个深度 agent 会话跑下来token 消耗量直接突破月费套餐的 5 倍以上。每卖出一个 20 美元的套餐,平台可能要承受 100 美元的推理成本。这不是经营不善,是模式本身失灵。

有开发者晒出账单,月费 200 美元,跑完深度 agent 任务后 API 账单多出了 400 多美元。平台会悄悄把超额用量转到按量计费通道,你看到账单的时候才明白,原来“包月无限”从来就没有真正存在过。

Anthropic 的一位工程师最近公开道歉,说自己过去嘲笑“AI 算力最终会按量计费”的预测是错的。他解释说,扩展 Agent 系统真的很难,现在的定价和限流不是想骗人,是“目前能想到的最好办法”。Claude 的产品经理也坦言,Agent SDK 从订阅池里剥离,不是因为不喜欢开发者,而是因为“Agent 用量实在太大了,订阅模式兜不住”。

八、所以,答案已经很明显了

AI 服务可能走向“双轨制”

固定月租 存储、基础功能与轻量对话

按量付费 深度推理、Agent 任务与重度算力

AI 订阅制注定走向消亡,不是因为哪个公司贪婪,也不是因为 AI 变得昂贵。而是因为AI 的商业本质和“电”一样,是基础设施,不是软件

当一项服务的边际成本不为零,而且重度用户的消耗量是轻度用户的几十倍甚至几百倍时,固定价格的订阅制就注定了是一个会崩盘的模式。轻度用户在替重度用户买单,重度用户被各种限额和降速搞得痛苦不堪,平台在亏损和差评之间走钢丝。三个人,没有一个人满意。

未来会走向什么?

答案是“双轨制”——存储按月收费,算力按量付费

这借鉴了电信行业“月租+流量”的逻辑。你付一个合理的月租,买的是固定的存储和基础对话能力;超出基础的部分、重度的算力消耗、deep reasoning 和 agent 自动任务,按实际 token 用量计费。谁用得多谁多付,公平透明。

这样,轻度用户不用觉得替别人买单,重度用户不用被限速憋屈,平台不用在亏损和挨骂之间走钢丝。所有人都知道自己付的钱去了哪里。

这就是基础设施的定价逻辑。不是变贵,而是变得“可计算”。

九、这对 fabr 意味着什么?

在这个大背景下,fabr(方博领航)在做的事情有更深一层的行业逻辑。

当 AI 服务的计费模式从“包月买断”走向“精细化计费”,企业最需要的东西就变了,不是“随便用”,而是“算得清每一笔 token 花在哪里、值不值得”

Meta 前不久向 6000 名员工发送内部备忘录,宣布对 AI 使用设置上限并进行预算管理,一旦 Token 支出出现异常增长,系统会自动发出警报。这是因为 AI 费用已经高到让大厂都不得不勒紧裤腰带。

fabr 的方向恰恰在回应这个新需求:帮企业把 AI 的花费用得更有价值。在 fabr 的统一工作台里,需求讨论、任务推进、AI 编程、测试验收是一条完整的链。

AI 消耗的每一个 token,背后都有一个明确的任务归属,这个 token 是为哪个需求花的、产出了什么价值、能不能被复用。当行业从“算力随便用”走向“算力精打细算”时,谁能把账算清楚,谁就握住了企业级 AI 的核心竞争力。

AI 的付费模式变革,不是短期的“涨价潮”。它是整个行业从“互联网式烧钱”走向“基础设施式计价”的必然路径。SemiAnalysis 的测试结果已经揭示,一套每月 20 美元的套餐,按 API 牌价折算的真实使用价值可能高达 400 美元。这种补贴不可能永远持续下去。

你之前付 20 美元,不是“赚到了”,而是平台在用资本替你垫付了算力成本。现在,这个账期到了。

AI 不是软件,是算力。算力的账单,迟早会有人来收。区别只在于你是在账单来之前想清楚怎么用,还是在账单来了之后才后悔“我怎么没想到”。


END

添加客服

咨询更多精彩内容