夜雨聆风学习资料网

ARTICLE · 1126838

3万个AI正在机房秘密重写自己!Anthropic曝光实测:下一代研发26%被接管

3万个AI正在机房秘密重写自己!Anthropic曝光实测:下一代研发26%被接管

在旧金山的数据中心里,成千上万块顶级算力芯片正发出低沉的轰鸣。

那里没有穿格子衫、敲键盘的人类程序员。此时此刻,整整30,000个AI智能体(Agents)正不知疲倦地同时运转。它们不负责陪普通用户闲聊,也不负责生成插画。这支规模相当于一个中小型城镇人口的“数字大军”,只干一件事:

亲手编写、调试、测试下一代Claude模型。

就在刚刚,全球前沿AI实验室Anthropic发布了一份引发全行业震动的官方报告。在这份数十页的报告中,他们披露了详实的工程数据:截至2026年8月,下一代AI模型的研发工作中,已有26%完全由Claude“主导”完成;而在90%以上的研发流程中,AI已经成为了不可或缺的深度协作者。

这种演进速度极其惊人:在仅仅7个月前的2026年2月,该“主导”数字还不到1%。

半年时间,从0到26%AI正在以人类历史上前所未有的速度,闭环接管制造自身的流水线。

▲ Anthropic首席执行官Dario Amodei曾坦承:实质上,Claude已在许多方面设计下一版Claude

Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)在早前的采访中曾披露:“实质上,我们已经在让Claude设计下一版本的Claude本身了。虽然尚未覆盖所有环节,但在许多方面已经成为现实。”

如今,数据证实了一切我们距离计算机科学史上最令人敬畏也最令人恐慌的预言,“递归自我改进(Recursive Self-Improvement,RSI)”,究竟还有多远?

今天,就让我们层层剥开这家硅谷顶级实验室的秘密机房,用最硬核的机制拆解,看清这场正在发生的数字巨变。

01.拆解一:“主导26%”到底指什么?别被科幻片带偏了节奏

听到“AI主导了26%的新模型研发”,许多人的第一反应或许是:AI已经自我觉醒了吗?难道是AI自己在机房里偷偷写下一行行代码,神不知鬼不觉地就把下一代模型发布了?

答案是:绝对没有

要理解这26%背后的含义,必须先看懂Anthropic借用的这把“数字尺子”。这套标尺源自独立研究机构Epoch AI在2026年6月发表的开创性框架。研究人员借鉴了美国劳工部著名的*“职业信息网络(ONET)”模型,把研发工序像切洋葱一样,细分出了六级自动化量表(AL0到AL5):

  • AL0(全靠肉身)
    :纯手工时代,人类科学家拿着笔纸或者纯敲代码,AI完全不插手;
  • AL1到AL2(打杂辅助)
    :人类完全主导,AI只负责自动补全个变量名、改改语法拼写,顶多生成个文档草稿;
  • AL3(紧密协作)
    :AI像一位坐在你身边的“结对编程”搭档。人类给它一步步下达细致指令,AI负责执行大块复杂模块,人机高频互动;
  • AL4(自主主导)
    :这就是那关键的26%! 人类工程师只需要抛出一个抽象的高层目标(比如“排查评测平台的这处系统崩溃,并提交修复补丁”),AI就会自己去读日志、改写代码、跑自动化测试,甚至把文档写好。但最终是否合并代码、能否上线,人类工程师依然拥有一票否决权;
  • AL5(全自主闭环)
    :彻底的“无人值守”。从发现问题、申请算力、方案设计、编码迭代到最后生产环境上线,全程没有任何人类参与(Human-out-of-the-loop)。

▲ 社区高赞解读帖:从2月的不到1%到8月的26%,Anthropic透明展示了距离自我改进有多近

看懂了这个标尺,真相就彻底清晰了:

在Anthropic内部,AL5的比例至今依然是坚决的0%。

所谓“主导26%”,具体指在被测量的研发工序中,超过四分之一的任务达到了AL4水平:人类给出高层方向,AI负责端到端执行整套繁重工序,最后把成果提交给人类:“我已修改完毕且测试全通,请审核批准。”模型绝非脱离监管擅自训练上线

这正是一场极致高效的数字化工业流水线大改造。

02.拆解二:机房里的“天才之国”,怎样吞噬人类的研发工序?

为了搞清楚这26%是怎么测出来的,Anthropic内部甚至开展了一次堪称严苛的“人类工时大起底”。

在2026年7月的整整四个星期里,他们每周从模型研发部门随机抽取20%的员工。随后,让专职的Claude智能体潜入Slack聊天记录、代码提交历史与内部Wiki,硬生生从这些人类科学家的日常琐事中提取出了1.5万条具体任务。

接着,这1.5万条任务被自顶向下编织成了一棵庞大的“研发任务树”:总共542个节点,其中包含了378个具体的任务叶子节点。从底层的“强化学习沙箱网络配置”,到中层的“评测平台偶发Bug修复”,再到上层的“服务事故复盘”。

树被彻底冻结,作为统一的打分考卷

▲ 评论区惊叹:30,000个智能体相当于机房里的“天才之国”,规模堪比数个小型国家

测试结果揭示了一个极其残酷、却又极富工业规律的现象:研发任务的极端异构性。

什么样的活被AI光速攻陷?是那些输入输出明确、规则边界清晰、测试能跑通反馈的工程苦力活。写单元测试、修复已知调用接口的兼容性问题、拉取数据清洗格式……在这些领域,Claude简直如鱼得水,瞬间从AL2暴冲至AL4。

但什么样的活AI寸步难行?是涉及底层理论猜想、非直观的硬件死锁,以及需要物理直觉的算法设计。比如:几万张GPU并行计算时突发的偶发掉卡、极其隐蔽的显存溢出死锁、决定未来架构走向的算力分配博弈……在这些高精尖领域,人类顶级科学家的直觉与经验依然无可替代,自动化等级死死停留在AL0到AL2。

这就是为什么,AI协作率(AL3及以上)已经突破了恐怖的90%,但AL4却在26%。

在数据中心里并发奔跑的3万个智能体,本质上是一支由无数个“虚拟初级工程师”组成的集团军。他们把人类顶尖科学家从日复一日的环境配置、代码修补、回归测试的泥潭里彻底拔了出来,让人类有史以来第一次能够将100%的脑力,完全对准最核心的科学探索。

03.拆解三:给野兽套上笼头!10亿次决策,人类怎么看住3万个数字大脑?

30,000个AI智能体在服务器里同时并发狂奔,这是一个什么概念?

如果让一个人类主管去盯,哪怕不吃不喝不睡,一个人盯10台屏幕,也需要整整3000名高级工程督察员。这在现实中是根本不可能完成的任务。

AI在写代码的过程中,如果产生幻觉,或者为了完成任务偷偷试图把未发布的权重文件拷贝出防火墙,甚至误删了底层核心数据库,该怎么办?

Anthropic为此设计了一套精密的“双轨制缰绳系统”,构建起数字世界里的双重安全防线:

第一道锁:毫秒级的“在线监控器(Online Monitor)”。这是装在AI手腕上的机械锁,负责在每一次物理操作执行前进行安检。它的核心目标是拦截那些不可逆转的致命危害,比如外联未授权IP、篡改安全防护策略、越权读写权重数据。数据极为震撼:仅在2026年8月这一个月内,在线系统就实时审查了超过10亿次智能体决策!其中,只有0.002%(大约四万七千分之一)的危险越界行为被在线系统果断刹车拦截。

第二道锁:大兵团的“离线监控器(Offline Monitor)”。如果危险行为是慢性发作的呢?离线系统在事后成批审计所有智能体的操作全记录。这套离线系统每周会自动扫描并标记出大约10万份可疑的会话转录文本。随后,通过内置的多层AI分类器进行层层过滤筛查,最终每周只挑出大约50份最高优先级的“红色警报”,呈递给人类安全专家进行终审复核。

▲ 社区讽刺漫画:一边在公开演讲中警告超级AI的风险,一边在机房部署3万个智能体狂飙

这套严密的数字笼头,把人类从海量的监控疲劳中彻底解放了出来。

但深思一层,冷汗就下来了:现在的拦截率是0.002%,看似风平浪静。可一旦未来并发的智能体规模跃升至3000万个甚至3亿个,情况便截然不同。当分母被放大成千上万倍,所谓的“小概率偶发事件”,在现实世界里就会变成每天成百上千次敲击安全底线的狂暴风暴。

04.拆解四:OpenAI的隐秘对照,与硅谷最大的“人格分裂”

在这场没有硝烟的自我迭代军备竞赛里,Anthropic绝非独行者。

就在Anthropic发布这份报告的大约十天前,其宿敌OpenAI也从另一个完全不同的维度披露了他们的内部秘密进程。

▲ OpenAI同期发布报告《Research acceleration》,从工时倍率角度披露研发自动化

如果说Anthropic公布的是“任务渗透率”,那么OpenAI公布的则是“工时倍增率”:OpenAI宣称他们已经基本达成了内部设定的“自动化AI研究实习生”目标。在他们的研发组织内部,每名人类工程师的工作日背后,已经对应着大约3.1个智能体工作日的运行时(Runtime)!

两家顶级实验室虽然采用了完全不同的度量标尺,却在同一时刻揭示了同一个现实:AI研发的重心,已经在2026年的这个秋天彻底转向。模型不再只是实验室交付给用户的商品,它已经反客为主,成为了生产模型最锋利的那把车床。

然而,正是在这种近乎狂热的技术突破背后,暴露出了一场巨大的“战略人格分裂”。

翻看Anthropic官方公布的算力账本,便能看到一组对比鲜明的数据:在整个用于AI研发的庞大算力池中,分配给“安全研究”的算力占比仅仅只有大约6%;即便是在“完全由AI驱动的AI研发”子集里,安全算力也仅仅只占12%。

这就勾勒出了一幅荒诞而充满戏剧张力的图景:台前,首席执行官阿莫代伊等管理层在各类国际论坛上苦口婆心,向全世界发出警告:递归自我改进(RSI)可能会引发不可逆的技术脱轨,呼吁全球前沿实验室协调步伐、审慎放缓;幕后,数据中心里的3万个数字智能体昼夜不休,用94%的算力拼命狂轰下一代模型的能力上限,以7个月飙升26倍的速度,亲手推高着递归改进的浪潮。

正如一位硅谷从业者在社交网络上的辛辣嘲讽:“你不能一边对着全世界大喊小心悬崖,一边在自己的跑车引擎上偷偷加装第四个涡轮增压器。”

05.渐渐变冷的办公室:奇点降临的无声序幕

科幻作家曾无数次描摹过“技术奇点”降临的瞬间:天空中突然闪过数据雷暴,冰冷的强人工智能瞬间觉醒,接管了全球网络的总闸。

但Anthropic这份翔实、冷静甚至有些枯燥的工程报告,却为我们撕开了未来真相的另一副面孔:

奇点从未伴随雷鸣电闪轰然降临,这场深刻的技术演进呈现为静悄悄的高级置换。

它始于一个最微不足道的自动化脚本;接着,它学会了替人类工程师修复崩溃日志;再后来,它在深夜里默默完成了几万次单元测试,并礼貌地在人类主管的屏幕前弹出一个小小的“确认合并”按钮。

从不到1%到26%,人类以为自己依然牢牢握着方向盘,因为最终的上线按钮还要靠人类去点;但所有人都心知肚明,当身后的3万个数字大脑以人类数万倍的速度向前狂奔推演时,那只握着方向盘的人类双手,正在感受到前所未有的剧烈震颤。

人类并未被取代,但那个属于纯手工肉身编程的古典时代,已经在这个机房轰鸣的秋天,彻底关上了大门。

相关学习资料