乐于分享
好东西不私藏

热点追踪|一家估值万亿的AI公司,反过来呼吁全球“踩刹车”——Anthropic到底在怕什么?

热点追踪|一家估值万亿的AI公司,反过来呼吁全球“踩刹车”——Anthropic到底在怕什么?

知识劳动的自动化拐点已经在内部发生!

如果AI开始自己造自己怎么办?

一家估值万亿的AI公司,反过来呼吁全球“踩刹车”——Anthropic到底在怕什么? 

一、“造火箭的人”突然说:也许我们该停一下

2026年6月4日,硅谷发生了一件耐人寻味的事——

Anthropic,这家估值逼近万亿美元、旗下拥有Claude、正筹备IPO的AI独角兽,在官方博客上发表了一篇署名长文,题目叫《当AI构建自身》(When AI Builds Itself),由联合创始人Jack Clark与研究负责人Marina Favaro联署。

一句话概括它的核心主张:

国际社会、政府与顶尖AI实验室应当共同建立一套“可验证的协调机制”,让人类在必要时,有能力主动放慢——甚至暂停——前沿AI的开发。

请注意,它不是说“立刻关停”,也不是道德姿态式的空洞宣言。它说的是:先把制度工具造好,把核查机制建起来,让“踩刹车”成为一个真实存在的选项。然后它又坦率地补了一句——

“如果只有我们停下,对手就会冲过去。所以这件事只有在多边可验证的前提下,才有意义。”

这种语气,在今天的AI行业几乎是一种“异端”。毕竟,所有人都在喊go go go。

二、它的恐惧不是天启,而是一组冷冰冰的数据

Anthropic这次之所以值得认真对待,原因在于——它在用自家内部数据说话,而不是抽象地谈哲学。

几个关键披露:

截至2026年5月,Anthropic合并进生产代码库的代码中,超过80%由Claude直接编写;而在2025年2月Claude Code推出之前,这个比例只是个位数。

一名工程师的原话被引在文中:“大概五个月了,我没亲手写过一行代码。”他们的工作已经退化为监督、审查、纠错,而非“创造”。

工程师人均每季度合并代码量,是2021–2024年间的 8倍。

把这些点连起来,Anthropic引出了一个在AI安全圈耳熟能详、但对公众仍然陌生的术语——

递归自我改进(Recursive Self-Improvement, RSI) 

通俗地说就是:AI不再只是帮人写代码,而是开始参与“制造下一代更强的AI”的工程闭环。一旦这个闭环完全闭合,进步的速度就不再被“人类程序员有多少小时一天”所限制,而被“有多少算力+多快跑完一次自动实验循环”决定。

Anthropic的表述非常克制:

“RSI尚未发生,也并非必然发生——但它可能比大多数机构的预案来得更快。”

它给出了三条路:

情景

含义

Anthropic的判断

① 技术大幅放缓

模型能力撞墙,进展变慢

并非主流预期,但即使在此情形下社会冲击依然巨大

② 持续强增益,人类仍主控

AI替代大量知识劳动,生产力爆炸,但控制权还在人手里

作者认为最可能的路径

③ 全面RSI

AI自主设计/训练继任者,人类角色急剧边缘化

不一定发生,但一旦发生,生存性风险框架就必须被严肃对待

真正让它按警报的,不是③一定会来,而是——①和②之间的社会适应期太短了,短到我们根本没建好护栏。

三、它提议的“暂停”长什么样?(以及为什么极难做到)

Anthropic没有天真到以为发篇博客就能让全球停训模型。它自己也知道:训练运行比导弹发射井更容易藏。

所以它提出的是一个听起来很像“核不扩散逻辑”的东西:

“踩刹车”应当是一个可被合法激活的选项——不是永久关停,而是可调的“减速阀”;

必须有核查机制(verifiable mechanisms),让各方确信别人也真的在减速,而不是打着协调的幌子偷偷冲刺;

AI公司之外的力量必须参与——立法者、独立研究者、国际组织——因为这件事已经超出了企业自律的范畴。

未来数月,Anthropic表示将围绕“递归自主进化的阈值定义”和“核验手段”组织跨国对话。

听起来合理?是的。

可实现吗?极度困难。

原因一句话就能说清:当你把“先进AI能力”同时定义为国家竞争力的战略资产和商业估值的命根子,“自愿减速”的全球条约“天然缺乏可信承诺机制”——这正是核军控谈判花了几十年才勉强建立脆弱信任的原因,而AI比核武器隐蔽得多。

四、所以——它是真心担忧,还是在“监管俘获”?

说到这里,公允的做法是引入另一面的声音,因为任何关于Anthropic的叙事,如果不包含这一层,就不配叫客观。

善意解读:这可能是行业里最诚实的一次自白

Anthropic从诞生起就把“Constitutional AI / 安全优先”写在旗帜上,核心团队出身于OpenAI安全派系出走,Dario Amodei本人长期警告就业冲击与失控风险。当它拿出自家数据证明“我们正在被自己造的东西加速替代”并公开呼吁协调减速时,至少说明一件事:它愿意把自己的商业节奏放在风险的秤上称一称。这在今天硅谷的“融资-扩产-IPO”机器里,算得上罕见。

怀疑论解读:动机没那么纯粹

但也有尖锐的批评——

有人直指这是一种“监管俘获”(regulatory capture)议程:通过推动高门槛的安全规则,把资源不足的小玩家挡在外面,巩固大厂寡头格局;

有人指出,Anthropic一边呼吁减速,一边限制自家最强模型Mythos的开放范围(只给政府和少量合作方),这既是安全审慎,也是把“威胁感”转化为“稀缺性溢价”的绝佳营销;

更有现实政治视角:此文发布节点恰好靠近IPO窗口、且恰逢美国AI行政命令博弈期——“主动喊刹车”在华盛顿有时候是最聪明的游说姿态。

这两种解读并不必然互斥。一个人可以同时真心害怕火灾,又在消防法规里暗暗算计自家的租金收益。大机构的行为从来都是多层动机叠加。

五、这件事对普通人到底意味着什么?

抛开硅谷的权力游戏不论,Anthropic这篇长文真正值得你留意的,其实不在“会不会真暂停”,而在三个更接地气的信号:

① 知识劳动的自动化拐点已经在内部发生。

当一个顶级AI公司自己承认80%的代码是AI写的、工程师已经转岗为“审阅者”,你就知道“AI替代白领”不再是2030年的预言,而是2026年的现场。

② “对齐研究”(让AI目标与人类利益一致)正在从学术议题变成基础设施。

Anthropic反复强调:减速的目的之一是给对齐研究争取时间。因为如果AI能力跑得太快、监督却越来越表面化,每一次部署本质上都是在盲飞。

③ 全球治理缺位,是最大的系统性风险。

国与国、司与司之间若只靠“我们都懂安全很重要”来自我约束,结局十有八九是囚徒困境——人人都知道该慢,人人都不敢先慢。Anthropic的价值在于把它说破了。

六、结语:我们不需要恐慌,但需要认真

"我们相信,让世界拥有放缓或临时暂停前沿AI研发的选项,将是件好事。"

这句话之所以打动人,不在于它给出了答案,而在于它承认了一个事实:技术的缰绳,不应该只在程序员的一台终端上。

Anthropic的呼吁会不会落地为全球减速机制?老实说——大概率不会以它理想中的形态发生。核查难题、地缘竞争、资本逻辑,每一道都是高墙。

但它至少做了一件有用的事:

把一个原本被封在论文和闭门会议里的命题——“如果AI开始自己造自己怎么办?”——放到了所有人的日光之下。

而这,本身就是踩刹车的开始。

你怎么看Anthropic的这份"喊停声明"?真诚的安全担当,还是精心计算的商业政治?欢迎在评论区留下你的判断。

END

(文中配图源自网络)

【本公众号文章合集链接】

名著品读

—— ●轻巧●风趣●时尚

名著赏析

—— ●深度●多维●独家

闽南风物

—— ●不同视角●不同风格

龙湖夜话

—— ● 夜行空原创小说简介与自评

热点追踪

—— ● 社会热点观察与思考

相关学习资料