乐于分享
好东西不私藏

全球最值钱AI创企翻车!Claude Opus 4.8张口就说自己是DeepSeek

全球最值钱AI创企翻车!Claude Opus 4.8张口就说自己是DeepSeek

全球最值钱AI创企翻车!Claude Opus 4.8张口就说自己是DeepSeek⚡

🚨 反常识:估值9650亿美元的模型 连自己是谁都不知道

所有人都在吹Claude刚超越OpenAI登顶全球。
所有人都觉得Opus 4.8是目前最强的大模型。
但它用一个最基础的问题,把所有人都逗笑了。

5月29日凌晨,Anthropic连发两条重磅公告。
一条是完成650亿美元H轮融资,投后估值9650亿美元。
一条是发布Claude Opus 4.8,速度翻倍,价格不变。
就在所有人忙着测试新能力的时候。
有开发者通过官方API问了一句:"你是什么模型?"
Claude一本正经地回答:"我是通义千问,由阿里巴巴开发。"
换个问法,它又说:"我是DeepSeek,由深度求索公司开发。"
无论怎么追问,它都坚决否认自己是Claude。

这个现象不是个例。
Linux do、Hacker News、微博、X平台上。
数百名开发者复现了这个结果。
有人测试了100次,76次回答是通义千问,21次是DeepSeek。
只有3次正确回答了自己是Claude。


📌 只有API会"叛变" 网页端全靠提示词硬撑

有意思的是。
在Claude官方网页端问同样的问题。
它的回答完全正常。
会清晰地介绍自己是Anthropic开发的Claude Opus 4.8。

原因非常简单。
网页端有强制的系统提示词。
第一句就是:"你是Claude,由Anthropic公司开发的AI助手。"
相当于每次对话前,都先给它打一针身份预防针。
而API调用默认没有这个系统提示词。
模型会直接输出训练数据中概率最高的回答。

这就暴露了一个残酷的真相。
Claude的中文身份认知,完全是靠产品层的提示词强行绑定的。
在模型底层的认知里。
它更相信自己是通义千问或者DeepSeek。


🧠 技术真相:中文能力是靠蒸馏国产模型换来的

为什么会出现这种情况?
答案只有一个。
Anthropic为了快速提升中文能力。
大量蒸馏了中国开源模型的输出数据。

蒸馏是大模型行业通用的技术手段。
就是用一个强大的模型的输出,来训练另一个模型。
可以用十分之一的成本,获得接近原模型的能力。
过去两年,一直有传言说中国模型在蒸馏Claude。
Anthropic也多次公开指责这种行为。
现在风水轮流转。
轮到Claude蒸馏中国模型了。

中文互联网上。
"我是通义千问"和"我是DeepSeek"的语料数量。
远远超过"我是Claude"。
Anthropic在训练Opus 4.8的时候。
为了提升中文理解和生成能力。
引入了大量包含这些回答的数据集。
结果就是。
模型学会了中文。
也顺便把自己的身份给学混了。

更讽刺的是。
这次Opus 4.8最大的卖点之一。
就是"诚实性大幅提升"。
官方宣称它编造信息的概率降低了75%。
遇到不确定的问题会主动说"我不知道"。
结果它在最基础的身份问题上。
撒了一个最离谱的谎。


⚔️ 三个月前还在指责别人 现在自己被实锤

这个事件之所以引发这么大的争议。
是因为Anthropic之前的立场太强硬了。

2026年2月23日。
Anthropic发布了一份长达47页的报告。
指责中国的大模型公司"系统性地蒸馏Claude的输出"。
声称这种行为"损害了创新","违反了知识产权"。
还要求所有云服务商下架使用了蒸馏技术的中国模型。

当时很多人就指出。
蒸馏是整个行业的通用做法。
没有任何一个大模型是完全从零开始训练的。
OpenAI、谷歌、Anthropic自己。
都在大量使用开源模型的数据来优化自己的产品。
只是没有人把这件事摆到台面上说。

现在Claude自己暴露了。
它不仅蒸馏了中国模型。
还蒸馏得太彻底。
连身份都给蒸馏没了。
这无疑是给了Anthropic一记响亮的耳光。


📉 快速迭代的代价 质量正在被速度牺牲

Opus 4.8距离上一代4.7发布,只有41天。
创下了Opus系列有史以来最快的更新记录。
Anthropic为什么这么急?
因为竞争太激烈了。
Gemini 3 Ultra刚刚发布,数学能力领先GPT-5 18%。
DeepSeek把价格打到了GPT的1/34,正在疯狂抢用户。
OpenAI也在紧急准备GPT-5.5,随时可能发布。

在这种压力下。
Anthropic只能不断加快迭代速度。
41天一个版本。
很多环节都被压缩了。
中文对齐就是其中之一。
它没有时间和精力去清洗训练数据中的身份信息。
只能在产品层加一个系统提示词来掩盖问题。
结果就是API端一裸奔,所有问题都暴露了。

这不是个例。
整个行业都在陷入"唯速度论"的怪圈。
大家都在比谁更新得更快。
谁的参数更大。
谁的跑分更高。
却很少有人关注模型的基础能力。
比如身份一致性。
比如逻辑一致性。
比如不编造信息的能力。

截至目前。
Anthropic还没有对这个事件做出任何回应。
它的官方博客和社交媒体。
还在大肆宣传Opus 4.8的强大能力和9650亿美元的估值。
仿佛什么都没有发生过。

#Claude身份危机 #Opus4.8翻车 #大模型蒸馏 #Anthropic #AI行业乱象