乐于分享
好东西不私藏

当AI开始建造自己:Anthropic呼吁全球暂停前沿AI开发,递归自我改进已迫在眉睫

当AI开始建造自己:Anthropic呼吁全球暂停前沿AI开发,递归自我改进已迫在眉睫

⚡ 划重点 2026年6月5日凌晨,Anthropic发布了一篇题为《当AI开始建造自己》的长文,短短十几个小时全球浏览量破千万。文章核心观点:AI正在以超出所有人预期的速度参与到自身的开发中,递归自我改进(Recursive Self-Improvement)可能在未来两年内成为现实。与此同时,Anthropic刚刚以9650亿美元估值超越OpenAI成为全球估值最高的私营AI公司,年化营收半年从90亿飙升至近470亿美元,IPO箭在弦上。 

 一家势头如此迅猛的公司,为何第一个喊出“请考虑暂停前沿AI开发”?文章首次公开了大量内部数据:Claude已写出超过80%的生产代码,一年内AI科研加速能力从3倍跃升至52倍,AI修复800个API错误仅需人类4年工作量。AI正在从“帮人类做”变成“告诉人类该做什么”。

 “当AI开始建造自己,人类还能来得及刹车吗?” 

01 递归自我改进:从理论概念到迫在眉睫的现实

 递归自我改进(RSI)指AI系统能够自主完成设计、测试、训练下一代AI的完整流程,人类不再扮演关键角色。一旦闭环形成,能力提升将进入自我加速的循环。过去这被认为是非常遥远的理论概念,但过去一年,几乎所有头部AI公司都在疯狂投入这个方向。OpenAI设立了专门的RSI准备岗位,目标2026年打造研究实习生级AI,2028年实现自动化AI研究员。DeepMind的AlphaEvolve已找到56年来首个对Strassen矩阵乘法算法的改进。创业公司如Recursive Superintelligence、Mirendil也纷纷入场。 

02 三组内部数据:AI正在接管研发

数据一:代码能力——截至2026年5月,Anthropic合并到生产代码库中的代码,超过80%由Claude编写。而2025年2月Claude Code上线前,这个比例还只是个位数。工程师人均每天合并代码量达到2024年的8倍。同时,Claude处理最高难度开放式任务的成功率,6个月内从26%跃升至76%。 

数据二:科研能力——给Claude一段训练小型AI模型的CPU代码,要求优化速度。2025年5月最先进的Opus 4模型平均加速约3倍;2026年4月Claude Mythos Preview达到52倍。而熟练人类研究员通常需要4-8小时才能达到约4倍加速。 

数据三:工程实践——2026年4月,Claude自主修复了超过800个API错误,将该类错误发生率降低约1000倍。负责工程师估计,同样的工作交给人类大约需要四年时间。 

03 AI不仅做得更快,还想得更远

 Anthropic内部做了一项回溯评测:把过去几年研究人员走过的错误研究方向(被证明是死胡同的路径)拿给不同版本的Claude模型,让它们提出替代方案。结果最新的Claude Mythos Preview给出的研究路径,有64%的概率被独立评审认为优于当时人类研究者的实际选择。这意味着AI已经不再只是帮助研究人员完成已经想好的工作,它正在越来越多地参与到“研究方向”本身的选择中。过去,人类负责决定“做什么”,AI负责“怎么做”;现在,AI已经开始告诉人类“应该做什么”了。 

04 时间表:2028年底概率60%

 Anthropic联合创始人杰克·克拉克在2026年5月估计:到2028年底,出现完全自动化AI研发的概率约为60%,到2027年底也已达到30%。如果这个判断正确,我们很快就会从“RSI是否可能”变成“当它真的出现时,我们该怎么办”。Anthropic提出了三种未来图景:①能力增长放缓但已广泛渗透;②复合效率提升,人类仍负责方向;③完整的递归自我改进。公司最担心后两种,因为它们留给社会、政府和安全研究的准备时间非常有限。 

05 暂停的囚徒困境:谁来按下第一个按钮?

 Anthropic呼吁:多个国家、多家前沿实验室在相同条件下共同减速,并且每一方都能验证其他参与者确实停了下来。但这个方案面临巨大的现实阻力。风险投资人大卫·萨克斯批评:所谓全球核查机制,实际效果是抬高准入门槛,让Anthropic、OpenAI、谷歌等大公司受益,而开源模型根本无法统一监管,最终形成垄断。更根本的问题是:在全球AI竞争白热化的环境下,谁在别人暂停时继续跑,谁就可能继承领先地位。没有任何一家公司或国家愿意主动放弃竞争优势。Anthropic自己也表示:“如果这样的机制真的能够建立起来,我们预计会减速或暂停。”——但“如果”两个字,或许比实现RSI本身还要困难。 

06 结语:当AI开始建造自己,人类必须开始思考

 无论Anthropic的动机是责任担当还是商业算计,这篇文章至少把问题摆在了所有人面前:技术的发展不会自动等待人类的准备,我们必须在技术到来之前就开始思考它所带来的影响和挑战。一年多以前,Claude还只能写不到10%的生产代码;现在,它已经写了80%。技术的进步往往是指数级的,当我们意识到它到来的时候,它可能已经改变了一切。 


 “当AI开始建造自己,人类还能来得及刹车吗?” 

 ✨ 关注智知宇宙 探索更多思想星河 ✨ 

相关学习资料