乐于分享
好东西不私藏

Anthropic 发布 AI 递归自我提升报告:Claude 已编写 80% 代码

Anthropic 发布 AI 递归自我提升报告:Claude 已编写 80% 代码

2026年6月4日,AI安全研究公司 Anthropic 在其官方研究院博客发布了一篇题为 **《When AI builds itself》(当AI构建自身)的重磅报告,通过大量内部数据揭示了 AI 正在加速 AI 自身开发 的惊人趋势。报告标题中提到的 递归自我提升**(Recursive Self-Improvement, RSI)概念,引发了全球科技界和媒体的广泛关注。

该推文在 Twitter/X 上获得超过 800万次浏览,不少国内外媒体以"Anthropic呼吁停止AI研究"为题进行了报道。但需要注意的是,原文并非单方面停工,而是提出在存在"可验证的全球协调机制"的前提下愿意减速。

原文链接: Anthropic Institute - When AI builds itself

📊 5 个最震撼的数据

1️⃣ 80% 以上的代码由 Claude 编写

截至 2026 年 5 月,Anthropic 代码库中合并的代码里,超过 80% 由 Claude 编写。而在 2025 年 2 月 Claude Code 发布之前,这个比例还只是个位数。

一年多时间,AI 从偶尔帮忙写几行,变成了扛起绝大部分的编写工作。

2️⃣ 工程师代码产出是 2024 年的 8 倍

2026 年第二季度,Anthropic 工程师每天合并的代码量是 2024 年的 8 倍。

工程师的角色正在从"写代码"转变为"指挥和审核"。

3️⃣ 最难的开放式任务,成功率飞升 50%

Claude 在最开放、最模糊的编程任务上,成功率从 2025 年底的 26% 涨到了 2026 年 5 月的 **76%**。

典型案例: 有一次常规升级导致上万个训练任务崩溃,工程师只给了 Claude 日志信息和集群访问权限。Claude 自行排查,发现是一个调试标志在作怪,整个过程仅用约 2小时(人类需2-3天)。

4️⃣ 代码优化能力 Claude 可达 52 倍

Anthropic 每发布一个新模型,都会做同一个测试:给 Claude 一段训练小型 AI 模型的代码,让其加速。

  • 2025年5月,Claude Opus 4:
     3 倍加速
  • 2026年4月,Claude Mythos Preview:
    52 倍加速
  • 人类研究员:4-8 小时做到 4 倍

5️⃣ AI 安全实验,Claude 把差距缩小 97%

Claude 被布置了一个开放式 AI 安全研究课题:弱模型能否可靠地监督强模型。

  • 两名人类研究员:
     花约一周,缩小 23%
  • Claude:
     消耗约 800 小时计算资源,成本约 1.8 万美元,缩小 97%

🧬 RSI(递归自我提升)是什么?

Anthropic 把这种趋势称为 **RSI(Recursive Self-Improvement,递归自我提升)**:

AI 帮人类写代码 → 写出的代码让 AI 变强 → 更强的 AI 写出更好的代码 → 如此循环往复

Anthropic 的原话是:

"We are not there yet, and recursive self-improvement is not inevitable. But it could come sooner than most institutions are prepared for."

"我们还没有走到那一步,递归自我提升也并非必然。但它到来的速度,可能比大多数机构准备好的要快。"

🔮 三种可能的未来

Anthropic 讨论了 AI 加速开发的三种走向:

走向
描述
Anthropic判断
① 涨着涨着就停了
指数曲线是S曲线,到拐点后放平
可能需要全新架构突破,或受限于能源/芯片瓶颈
② AI 加速,人类仍掌舵
100人公司做出过去1万人的成果,每人指挥一组AI Agent
当前最可能的走向
,瓶颈转移到代码审查等环节
③ AI 完全自我迭代
AI自主设计并训练下一代,人类退到监督验证位置
如未解决对齐问题,偏差可能累积导致失控

🎯 博客背后的动机

为什么 Anthropic 选择在这个时间点发布这篇博客?

  1. IPO 前夕:
     Anthropic 刚刚递交了 IPO 文件,据《华尔街日报》报道,估值接近 1 万亿美元
  2. 行业升温:
     OpenAI 此前也在官方博客中提到过 AI 递归自我提升的趋势
  3. 安全关切:
     联合创始人 Jack Clark 在社交平台上表示:"我现在相信,递归自我改进在 2028 年底之前发生的概率是 60%"

⚡ 关键时间线

  • 2021-2023:
     人类编写所有代码
  • 2023-2025:
     AI 聊天机器人生成代码片段,人类复制粘贴
  • 2025-2026:
     编码 Agent 自主编写/编辑完整文件
  • 今天:
     自主 Agent 运行代码并委托工作给其他 Agent
  • 未来:
     Agent 可能构建并训练自己的后继者

📌 来源与参考

  • Anthropic 官方博客:When AI builds itself
  • Anthropic CEO Dario Amodei 相关表态
  • Scientific American 报道:Anthropic warns AI may soon begin recursive self-improvement
  • 程序员鱼皮解读文章(参考来源)

本文基于 Anthropic 官方报告及多家媒体公开信息整理,旨在客观呈现 AI 领域最新发展动态。


end  // by Alice

相关学习资料