乐于分享
好东西不私藏

开源模型正在挤干AI公司的利润——GLM 5.2引发的利润率崩溃讨论

开源模型正在挤干AI公司的利润——GLM 5.2引发的利润率崩溃讨论

开源模型性能逼近Claude Opus 4.8,价格却只有1/30——AI行业的定价权正在瓦解。

Hacker News上最近有个帖子火了:"GLM 5.2 and the coming AI margin collapse"——357分,225条评论。

帖子的论点很简单:智谱把GLM 5.2用MIT协议完全开源了。性能在多个基准上只比Claude Opus 4.8差一两个百分点,API价格却差了30多倍。

这不是个案。腾讯Hy3刚用Apache 2.0开源,DeepSeek V4的定价几乎等于白送。一场从价格端发起的战争,正在从根上动摇闭源AI公司的生意。


0x00 · 差距有多大

先看几个冷数字。

GLM 5.2,API输入约5.00。差33倍。

DeepSeek V4 Flash,输出30.00。差100倍以上。

腾讯Hy3的API,据官方说约"GPT-4级别的十分之一"。

性能呢?

GLM 5.2在FrontierSWE上只比Opus 4.8低1%,领先GPT-5.5 1%。Terminal-Bench 2.1拿81分(Opus 4.8是85)。在所有长程基准里,它排开源第一。

Hy3在SWE-bench Verified拿78分,VentureBeat的评价是"以GLM-5.2一半参数量,除编码外全面领先"。

一句话:性能差距缩到个位数百分点,价格差距还在三位数倍。

0x01 · 算一笔账

Martin Cid Magazine帮我们算了。

月均1000万次API调用的创业公司。全部用Claude Opus 4.8,月账单轻松跑几十万美元。全部换成GLM-5.2,月省$75,000。

三个工程师的年薪,省了。

这还只是API模式。如果你选自部署——GLM-5.2是MIT协议,Hy3是Apache 2.0——自己买几张GPU跑,连API的钱都省了。

Coinbase的CEO Brian Armstrong最近公开说了句很有意思的话:他提议试验"更便宜的中国开源权重AI模型"来控制失控的AI账单。Coinbase,美国上市公司,CEO公开说要用中国开源模型——一年前想都不敢想。

而另一边,据媒体报道,微软悄悄取消了大部分内部Claude Code许可——因为计算成本超过了它本想替代的人类员工成本。Uber四个月烧完了2026全年的AI预算。

这不是个别公司"算错账"。这是整个行业的问题。

0x02 · Token税

这场战争不止是"开源比闭源便宜"。它暴露了AI行业一个更深的结构性病灶。

Tech Times给了它一个名字:Token税收(Token Tax)。

核心发现:传统SaaS公司的毛利率在75-85%。AI原生产品呢?2026年预测只有52%。比传统SaaS低23到33个百分点。

为什么?因为每次用户调用你的AI产品,你都得向底层模型供应商付token费。用户用得越多,你成本越高。这不是SaaS的"规模效应",这是"规模惩罚"——用越多亏越多。

Goldman Sachs预测,到2030年Agent驱动的token消耗将增长24倍。Agent不是"调一次API"那么简单——它把一次请求展开成推理链、工具调用、重试循环。每一次展开都在烧钱。

Cursor——年入上亿美元的明星AI编程工具——据分析直到最近都在亏着卖。5,000。

你的产品越成功,用户用得越多,你亏得越狠——这叫什么商业模式?

0x03 · 开源怎么破的局

开源模型从三个方向同时撕开了这道口子。

第一,定价权转移。 当GLM-5.2和DeepSeek把API价格压到接近零,闭源公司只有两条路:跟着降(吃自己的利润),或者不降(丢客户)。OpenAI和Anthropic已经在降了——GPT-5.4-nano输入1.00——但跟0.14比,还是贵。

第二,自部署解放。 MIT和Apache 2.0意味着你不用给任何人付token费。买GPU自己跑。成本从"按用量付费"变成了"固定资本支出"。这才回到了传统SaaS的经济模型——规模越大,边际成本越低。

第三,利润率的底牌。 DeepSeek最近披露了一个挺炸的数据:它的模型理论利润率是成本的545%。也就是说,即使价格压到现在的白菜价,它还在赚钱。这反过来暗示:闭源API的定价里有多少是纯品牌溢价?

0x04 · 谁会死

不是说闭源公司都要倒闭。OpenAI和Anthropic还有品牌、有生态、有前沿研究。GPT-5.5-pro的定价(180输出)说明高端市场还有溢价。

但中端和低端正被快速吃掉。

如果你的AI产品没有独特技术壁垒,只是"在GPT/Claude外包一层壳"——当开源模型性能追上来、价格往零跑的时候,你的定价权瞬间蒸发。

真正能活下来的,是那些把AI嵌进产品里的公司——客户为"解决了什么问题"付费,不是为"调用了哪个模型"买单。

这场利润率塌方,杀的不是AI行业。杀的是靠转卖别人token为生的中间商。


参考来源:

  • Z.ai 官方博客 - GLM-5.2: The new leader in long-running coding benchmarks
  • VentureBeat - Tencent's Apache-licensed Hy3 takes on GLM-5.2 at half the size
  • Hacker News - GLM 5.2 and the coming AI margin collapse (357 points)
  • Tech Times - AI Agent Economics: Token Tax Locks Gross Margins 30 Points Below SaaS
  • The Straits Times - DeepSeek reveals theoretical 545% profit margins
  • Martin Cid Magazine - Zhipu AI GLM-5.2: Open weight model with Opus performance
  • OpenAI / Anthropic / Google / DeepSeek 官方定价页
  • Cryptopolitan - Coinbase CEO eyes cheaper Chinese open-source AI models