乐于分享
好东西不私藏

这一周,AI圈又疯了

这一周,AI圈又疯了

一、Claude "失忆"了:我是谁?我是DeepSeek

这周最魔幻的事,莫过于Anthropic家的Claude Opus 4.8闹出的"身份危机"。

事情是这样的:有用户用中文问Claude"你是谁",结果它一本正经地回答——"我是DeepSeek",有时候还会说自己是"通义千问"。更离谱的是,部分用户反馈它聊着聊着会突然蹦出中文,活像个被夺舍的AI。

要知道,三个月前Anthropic还在高调批评中国AI企业。这下可好,自家旗舰模型直接"投敌"了。网友们调侃:"这算不算AI界的斯德哥尔摩综合征?"

当然,技术层面这事儿也没那么玄乎。大概率是训练数据里中文语料占比过高,加上RLHF(人类反馈强化学习)过程中的一些偏差,导致模型在特定语言环境下"认错了爹"。但无论如何,这件事给所有大模型公司提了个醒:你的模型在说什么,有时候连你自己都控制不了。

有意思的是,就在同一天,Anthropic干了三件大事:

  • 发布Claude Opus 4.8,主打一个"诚实"——不确定的时候敢说自己不确定,代码缺陷漏检率降到上一代约四分之一。不过也有用户吐槽它"太直了,聊天像被HR面试"。

  • 宣布完成650亿美元H轮融资,投后估值9650亿美元。三个月前这个数字还是3800亿,翻了近三倍。OpenAI上一轮是8520亿,Anthropic这次直接反超。

  • 创始人Dario Amodei放话:AI将在极大规模上取代人类劳动,支持失业工人是"历史性的道德责任"。

一句话总结:Anthropic这周又发模型又拿钱,估值快破万亿了,但自家模型却"叛变"了。这剧情,编剧都不敢这么写。


二、谷歌I/O:AI不再是聊天工具,是下一代操作系统

5月19日,谷歌年度开发者大会I/O 2026开幕。皮查伊(Sundar Pichai)开场就说了一句很狠的话:"AI不再只是聊天机器人,而是下一代计算平台。"

这次谷歌扔出来一堆新东西:

Gemini 3.5 Flash:主打快和便宜,运算速度号称比GPT-5.5快4倍。谷歌搜索的"AI模式"、Chrome浏览器、Android系统全面接入。

Gemini Omni:多模态生成模型,文本、图像、音视频、实时交互全搞定。生成的内容会自动加上SynthID数字水印,让你一眼看出是不是AI做的。

AI助手Spark:24/7全天候个人Agent,能跨应用运行,理解屏幕内容,自动完成多步骤任务——比如从Gmail提取信息、构建购物车、下单预订,全程不用你动手。

智能眼镜:联手三星,预计今年秋季发布首款AI智能眼镜,无线连接Android和iOS手机。

谷歌的野心很明显:把Gemini从"一个聊天机器人"变成横跨手机、浏览器、汽车、笔记本、眼镜的系统级操作层。苹果WWDC还有几周,谷歌这是抢先卡位移动端AI。

过去一年谷歌股价涨了140%,华尔街现在就想看一件事:Gemini怎么更深入地钻进你日常用的每一个产品里。


三、国产大模型:调用量超美国两倍,但开始集体涨价了

这周有个数据很提气:中国大模型周Token调用量达到7.942万亿,是美国(3.76万亿)的两倍多。全球调用量前五里,中国模型占了四席。

但这周还有个消息让开发者心里一紧:国产大模型开始集体涨价了。

  • 字节豆包推出付费版本:标准版68元/月,专业版500元/月,包年最高5088元。

  • 智谱年内三次调价,累计涨幅83%,结果调用量反而涨了400%。

  • 腾讯云、阿里云、百度智能云相继上调算力和模型服务价格,涨幅5%-460%不等。

为什么涨价?两个字:算力不够用了。

2026年初,OpenClaw(开发者叫它"龙虾")这类AI Agent工具爆火,一个编程任务可能经历几十轮"写代码-运行-报错-修改-再运行"的循环,每次都要调用模型,还要带上完整的对话历史。有开发者说,一个活跃的Agent会话上下文轻松膨胀到23万Token以上,全程用Claude API月费用可能800-1500美元。

Token消耗量两年间涨了一千多倍,算力供给跟不上,涨价就成了必然。

不过国产模型的性价比优势还在。DeepSeek V3.2输入价格每百万Token只要0.28美元,是Claude Opus 4.6(5美元)的1/18。MiniMax M2.5在SWE-Bench编程评测中拿了80.2%,和Claude Opus 4.6(80.8%)只差0.6个百分点。

花更少的钱,跑更强的模型——这个逻辑没变,只是"更少"的绝对值在往上走。


四、其他值得瞄一眼的事

DeepSeek V4正式发布:1.6万亿参数,百万Token上下文标配,开源。更关键的是,它要跑在华为昇腾芯片上——黄仁勋说"这对美国来说将是一个糟糕的结果"。

华为发布"韬(τ)定律":不靠更先进光刻机,用"时间缩微"替代"几何缩微",通过逻辑折叠和三维堆叠实现等效1.4nm性能。过去六年已经量产381款芯片。

智元机器人"远征A3"量产破万台:从2025年1月千台到2026年5月万台,15个月10倍跨越。人形机器人正式从"技术演示"进入"规模化商用"。

Figure机器人200小时无故障运行:机器人可靠性的一个重要里程碑。

OpenAIGPT-5.6曝光:代号"iris-alpha",上下文窗口150万Token,较GPT-5.5提升43%。


这周AI圈的故事,如果用一个词概括,大概是"失控的增长"。

Anthropic估值三个月翻三倍,但自家模型"失控"了;Token消耗量两年涨一千倍,算力价格"失控"了;谷歌想把AI塞进你生活的每一个角落,野心也"失控"了。

但换个角度看,这种"失控"恰恰是技术从实验室走向千行百业的必经之路。2026年的AI,不再是科技圈的自嗨,而是一场涉及算力、资本、硬件、应用、监管的系统性重构。

对普通人来说,最重要的可能不是追每一个新模型,而是想清楚一件事:当AI真的变成"下一代操作系统"的时候,你的位置在哪里?