两个小时烧掉1200美元,这事要是发生在手机发布会晚宴上,大家最多骂一句铺张。结果它出现在一场AI写代码演示里,我现在正式宣布:很多公司搞AI,不是在提效,是在花钱表演提效。 更狠的是,Uber到2026年4月就把全年AI编码预算花完了,后面高管自己都承认,钱花得越来越难解释。

用量冲榜像健身房打卡,汗出了不少,肌肉不一定长
这事最离谱的,不是工程师爱用AI,而是公司把“谁用得多”做成了内部排行榜。Uber在2026年1月开始把 Claude Code 和 Cursor 大规模推给大约5000名工程师,2月大约三分之一的人在用,3月采用率一下冲到84%。重度用户月花费能到500到2000美元,CTO那场直播演示,两小时就烧了1200美元。
你品,你细品。
工具本身没原罪,问题出在KPI。你要是考核修了多少 bug、上线了多少功能,那大家会围着结果转。你考核“用了多少”,那最后冲榜就会变成一种集体行为艺术。就像健身房只看你刷卡次数,不看体脂和力量,最后最努力的人,可能只是最会进门的人。

agentic工具像请了个不睡觉的实习生,勤快是真勤快,电表转得也是真快
以前那种AI补全,顶多算给你递个扳手。现在这类 agentic 编程工具,已经是“自己看代码库、自己拆任务、自己改文件、自己跑测试”的路子。听起来很美,成本模型也跟着变了。
Uber的问题就出在这儿。传统软件订阅,财务还能按人头估个八九不离十;现在这种按用量、按token计费的模式,越能干,越容易失控。Uber后面直接给每名员工、每款 agentic 工具设了每月1500美元上限,还上了内部仪表盘盯消耗。这个操作,我给8分,至少终于想起“电费单”也是账。
好消息是,大家终于开始管了。坏消息是,往往都是烧穿预算之后才开始管。

微软也开始收网,说明这事真不是一家公司的抽风
如果只是Uber翻车,那还能当个乐子看。麻烦就在这儿——微软也在差不多时间开始取消大部分 Claude Code 许可,把不少开发者往自家的 GitHub Copilot CLI 引。报道里提到,微软早在2025年12月就开放内部试用,后来发现 Claude Code 在内部火得有点太猛,于是开始往回收。
这说明什么?
说明大厂现在也在重新做一道数学题:外部AI工具到底是在帮我省人力,还是只是把成本从工资单挪到了token账单上。Sam Altman 之前就讲过一个方向,说未来智能会像水电一样按表收费。愿景很科幻,财务看了很头疼。

最该挨批的,不是AI贵,是“先冲量后算账”的管理脑回路
让我们来还原一下某些管理层的心路历程:“先把采用率做上去,故事就好讲了;至于产出怎么衡量,以后再补。”——合理吗?对PPT很合理,对预算很不友好。
Uber总裁 Andrew Macdonald 后来直接说了,现阶段很难把这些AI使用数据,和“多交付了多少有用功能”画上明确等号。问题就卡在这儿:如果钱烧得飞快,结果又说不清,那这个故事讲到后面,只能从“AI优先”变成“AI限流”。
这事严重吗?挺严重。因为它不是偶尔翻车,而是每天都在花钱。什么时候能原谅?只有一种情况:你真能把上线效率、故障率、用户体验这些结果拿出来,而不是拿排行榜截图当捷报。

收起玩笑说句正经的:这波新闻更适合谁看?适合所有正在猛推AI落地的团队,也适合那些把“用上了”当成“做好了”的管理者。普通读者也能看明白一件事,AI工具不是不能买,问题是别把电表当战绩。真要上这类工具,适合目标明确、流程清楚、知道怎么算ROI的团队;要是连“花这钱换回了什么”都答不上来,那先别冲。你们觉得,内部排行榜按用量排,是激励创新,还是高级版瞎折腾?
温馨提示:文中部分信息整理自公开资料与网络信息,数据存在更新或偏差,欢迎理性交流与指正,具体请以官方最新公布为准。
夜雨聆风