夜雨聆风学习资料网

ARTICLE · 1125365

OpenAI跳过来才四个月,他公开辞职骂整个AI圈在赌命

OpenAI跳过来才四个月,他公开辞职骂整个AI圈在赌命

一条帖子炸出来的内部人

我刷到这条新闻的时候,第一反应是去查名字。中文源里几乎都只写"Anthropic一名研究人员",连个姓都不给,这种爆料在自媒体手里最容易被写成匿名小作文。我翻了 Fortune、Telegraph 和 Anadolu 三家英文媒体的原稿,才把人对上号——这位公开辞职的研究员叫 Jacob Coxon,今年二十七岁,做的是预训练方向。

他不是刚入行的新人。按 Fortune 的说法,过去三年他一直在做预训练研究,前一段在 OpenAI,最近一段在 Anthropic。预训练是什么概念?就是大模型最烧钱、最底层、决定模型能力上限的那一步,ChatGPT 和 Claude 底下那套东西,都是这个阶段喂出来的。一个既在 OpenAI 又在 Anthropic 待过的预训练研究员,跳出来说两家公司都在拿命赌,这话的分量跟外部评论员骂街完全不是一回事。

他辞职那天发的原帖,我对着 J.P. Morgan 那份行业备忘录里抄录的原文逐字看了一遍。原话翻译过来大致是:"我今天从 Anthropic 辞职了。过去三年我一直在 OpenAI 和 Anthropic 做预训练研究。这两家公司都没有在负责任地行事。它们正在一头冲向自我改进的超级智能,并且拿我们所有人的生命下注。"

注意他骂的不是某一家。从 OpenAI 跳到 Anthropic,本来 Anthropic 在外界眼里是"安全派"的代表,成立时就打着对齐和安全的旗号。结果他两边都待过,两边都判了不合格。这个反差是整件事最扎心的地方——你以为换一家公司能换到安全感,换完发现赛道本身就跑偏了。

为什么是现在炸出来

时间点很微妙。Coxon 是九月初辞的职,但这两天中文圈突然开始转这条消息,是因为九月底又出了一件事。

我特意去核了那个日期:九月二十九日,谷歌、Anthropic、OpenAI、英伟达这几家美国头部公司的负责人,一起在白宫签了一份叫《超级智能协议:前沿责任联合承诺》的文件。表面上是行业自愿承诺,训练和部署前沿模型要遵守某些安全条款。结果协议墨迹未干,Coxon 这种内部人的公开辞职就被翻出来重新讨论——一个是行业举手承诺负责任,一个是一线研究员说你们就是在演戏。这两件事放在一起,味道非常讽刺。

还有一个细节我是在 Telegraph 的报道里看到的:同期有消息说,Anthropic 拒绝把它最新一版技术交给英国 AI 安全研究所(AISI)做外部测试。一边在白宫签自愿承诺,一边把最新模型挡在英国监管测试门外,Coxon 那番话的可信度,因为这个动作又加了一层。

更值得玩味的是 Anthropic 内部的反应。J.P. Morgan 那份备忘录里记录了一个叫 Evan 的同事公开回应,原话是"Jacob 说得对……我们是真的发自内心相信 AI 可能杀死全人类,我个人觉得未来十年内这个概率超过百分之十"。Evan 说这话的时候并没有跟着辞职,他还留在 Anthropic。我的判断是,这种"人还在公司里、但嘴上承认概率超过一成"的状态,比 Coxon 一个人走更能说明问题——连留下来的人都不信自己在做的事是安全的。

预训练研究员到底在怕什么

外行人看 AI 新闻,总觉得安全讨论是遥远的末日预言。我特意去查了 Coxon 具体怕的是什么,不是笼统的"机器人造反",而是一个非常具体的链条:自我改进的超级智能。

逻辑是这样的:当一个强到一定程度的模型,开始被用来参与训练下一代更强的模型,迭代速度就会从"人花几个月调"变成"模型自己几周跑一轮"。这个临界点一旦过去,人类对能力边界的把控就会迅速失效。Coxon 说的"racing straight to self-improving superintelligence",指的就是各家公司为了抢这个迭代权,把安全测试、外部审查、部署门槛全部往后推。

这不是科幻段子。今年六月 Google DeepMind 还有一位叫 Alex Turner 的安全研究员也公开辞职过,TCAI 整理的那份内部人警告清单里,他排在很靠前的位置。短短几个月,DeepMind 走一个、Anthropic 走一个,都是做安全或预训练的核心岗。我觉得这件事真正的信号不是某个人情绪崩溃,而是前沿实验室里,愿意为"慢一点"说话的人正在被赛道速度挤出去。

我的看法

我翻完这一圈信源,有一个感觉特别强烈:Coxon 在 Anthropic 只待了四个月就走,说明他不是被某一件具体的事气走的,而是入职之后发现这家公司的实际节奏和对外讲的安全故事对不上。四个月足够一个资深预训练研究员看清楚内部是真在做安全,还是把安全当 PR。

他原话里那句"拿我们所有人的生命下注",听上去夸张,但放在预训练这个岗位上,其实是技术判断而不是情绪宣泄。一个亲手参与训练下一代模型的人,告诉你这列火车没有刹车,你至少应该认真听一下。至于白宫那份自愿承诺有没有用,我觉得 Coxon 这条帖子本身就是答案——承诺是签给监管看的,辞职才是内部人真正投的票。

相关学习资料