
知识劳动的自动化拐点已经在内部发生!
如果AI开始自己造自己怎么办?
一家估值万亿的AI公司,反过来呼吁全球“踩刹车”——Anthropic到底在怕什么?

一、“造火箭的人”突然说:也许我们该停一下
2026年6月4日,硅谷发生了一件耐人寻味的事——
Anthropic,这家估值逼近万亿美元、旗下拥有Claude、正筹备IPO的AI独角兽,在官方博客上发表了一篇署名长文,题目叫《当AI构建自身》(When AI Builds Itself),由联合创始人Jack Clark与研究负责人Marina Favaro联署。
一句话概括它的核心主张:
国际社会、政府与顶尖AI实验室应当共同建立一套“可验证的协调机制”,让人类在必要时,有能力主动放慢——甚至暂停——前沿AI的开发。
请注意,它不是说“立刻关停”,也不是道德姿态式的空洞宣言。它说的是:先把制度工具造好,把核查机制建起来,让“踩刹车”成为一个真实存在的选项。然后它又坦率地补了一句——
“如果只有我们停下,对手就会冲过去。所以这件事只有在多边可验证的前提下,才有意义。”
这种语气,在今天的AI行业几乎是一种“异端”。毕竟,所有人都在喊go go go。

二、它的恐惧不是天启,而是一组冷冰冰的数据
Anthropic这次之所以值得认真对待,原因在于——它在用自家内部数据说话,而不是抽象地谈哲学。
几个关键披露:
截至2026年5月,Anthropic合并进生产代码库的代码中,超过80%由Claude直接编写;而在2025年2月Claude Code推出之前,这个比例只是个位数。
一名工程师的原话被引在文中:“大概五个月了,我没亲手写过一行代码。”他们的工作已经退化为监督、审查、纠错,而非“创造”。
工程师人均每季度合并代码量,是2021–2024年间的 8倍。
把这些点连起来,Anthropic引出了一个在AI安全圈耳熟能详、但对公众仍然陌生的术语——
递归自我改进(Recursive Self-Improvement, RSI)
通俗地说就是:AI不再只是帮人写代码,而是开始参与“制造下一代更强的AI”的工程闭环。一旦这个闭环完全闭合,进步的速度就不再被“人类程序员有多少小时一天”所限制,而被“有多少算力+多快跑完一次自动实验循环”决定。
Anthropic的表述非常克制:
“RSI尚未发生,也并非必然发生——但它可能比大多数机构的预案来得更快。”
它给出了三条路:
情景 | 含义 | Anthropic的判断 |
① 技术大幅放缓 | 模型能力撞墙,进展变慢 | 并非主流预期,但即使在此情形下社会冲击依然巨大 |
② 持续强增益,人类仍主控 | AI替代大量知识劳动,生产力爆炸,但控制权还在人手里 | 作者认为最可能的路径 |
③ 全面RSI | AI自主设计/训练继任者,人类角色急剧边缘化 | 不一定发生,但一旦发生,生存性风险框架就必须被严肃对待 |
真正让它按警报的,不是③一定会来,而是——①和②之间的社会适应期太短了,短到我们根本没建好护栏。

三、它提议的“暂停”长什么样?(以及为什么极难做到)
Anthropic没有天真到以为发篇博客就能让全球停训模型。它自己也知道:训练运行比导弹发射井更容易藏。
所以它提出的是一个听起来很像“核不扩散逻辑”的东西:
“踩刹车”应当是一个可被合法激活的选项——不是永久关停,而是可调的“减速阀”;
必须有核查机制(verifiable mechanisms),让各方确信别人也真的在减速,而不是打着协调的幌子偷偷冲刺;
AI公司之外的力量必须参与——立法者、独立研究者、国际组织——因为这件事已经超出了企业自律的范畴。
未来数月,Anthropic表示将围绕“递归自主进化的阈值定义”和“核验手段”组织跨国对话。
听起来合理?是的。
可实现吗?极度困难。
原因一句话就能说清:当你把“先进AI能力”同时定义为国家竞争力的战略资产和商业估值的命根子,“自愿减速”的全球条约“天然缺乏可信承诺机制”——这正是核军控谈判花了几十年才勉强建立脆弱信任的原因,而AI比核武器隐蔽得多。

四、所以——它是真心担忧,还是在“监管俘获”?
说到这里,公允的做法是引入另一面的声音,因为任何关于Anthropic的叙事,如果不包含这一层,就不配叫客观。
善意解读:这可能是行业里最诚实的一次自白
Anthropic从诞生起就把“Constitutional AI / 安全优先”写在旗帜上,核心团队出身于OpenAI安全派系出走,Dario Amodei本人长期警告就业冲击与失控风险。当它拿出自家数据证明“我们正在被自己造的东西加速替代”并公开呼吁协调减速时,至少说明一件事:它愿意把自己的商业节奏放在风险的秤上称一称。这在今天硅谷的“融资-扩产-IPO”机器里,算得上罕见。
怀疑论解读:动机没那么纯粹
但也有尖锐的批评——
有人直指这是一种“监管俘获”(regulatory capture)议程:通过推动高门槛的安全规则,把资源不足的小玩家挡在外面,巩固大厂寡头格局;
有人指出,Anthropic一边呼吁减速,一边限制自家最强模型Mythos的开放范围(只给政府和少量合作方),这既是安全审慎,也是把“威胁感”转化为“稀缺性溢价”的绝佳营销;
更有现实政治视角:此文发布节点恰好靠近IPO窗口、且恰逢美国AI行政命令博弈期——“主动喊刹车”在华盛顿有时候是最聪明的游说姿态。
这两种解读并不必然互斥。一个人可以同时真心害怕火灾,又在消防法规里暗暗算计自家的租金收益。大机构的行为从来都是多层动机叠加。

五、这件事对普通人到底意味着什么?
抛开硅谷的权力游戏不论,Anthropic这篇长文真正值得你留意的,其实不在“会不会真暂停”,而在三个更接地气的信号:
① 知识劳动的自动化拐点已经在内部发生。
当一个顶级AI公司自己承认80%的代码是AI写的、工程师已经转岗为“审阅者”,你就知道“AI替代白领”不再是2030年的预言,而是2026年的现场。
② “对齐研究”(让AI目标与人类利益一致)正在从学术议题变成基础设施。
Anthropic反复强调:减速的目的之一是给对齐研究争取时间。因为如果AI能力跑得太快、监督却越来越表面化,每一次部署本质上都是在盲飞。
③ 全球治理缺位,是最大的系统性风险。
国与国、司与司之间若只靠“我们都懂安全很重要”来自我约束,结局十有八九是囚徒困境——人人都知道该慢,人人都不敢先慢。Anthropic的价值在于把它说破了。

六、结语:我们不需要恐慌,但需要认真
"我们相信,让世界拥有放缓或临时暂停前沿AI研发的选项,将是件好事。"
这句话之所以打动人,不在于它给出了答案,而在于它承认了一个事实:技术的缰绳,不应该只在程序员的一台终端上。
Anthropic的呼吁会不会落地为全球减速机制?老实说——大概率不会以它理想中的形态发生。核查难题、地缘竞争、资本逻辑,每一道都是高墙。
但它至少做了一件有用的事:
把一个原本被封在论文和闭门会议里的命题——“如果AI开始自己造自己怎么办?”——放到了所有人的日光之下。
而这,本身就是踩刹车的开始。
你怎么看Anthropic的这份"喊停声明"?真诚的安全担当,还是精心计算的商业政治?欢迎在评论区留下你的判断。

(文中配图源自网络)
【本公众号文章合集链接】
—— ●轻巧●风趣●时尚
—— ●深度●多维●独家
—— ●不同视角●不同风格
—— ● 夜行空原创小说简介与自评
—— ● 社会热点观察与思考

夜雨聆风