夜雨聆风学习资料网

ARTICLE · 1121984

OpenAI 的安全主管走了,第三次

OpenAI 的安全主管走了,第三次

QUOTE

安全评估不是决策的输入,而是决策的装饰

—— 零号物种

本文看点

01

三次安全团队离职,同一批关键词

02

安全评估是装饰,不是输入

03

用 2023 年的组织,跑 2026 年的速度

2026 年 10 月 3 日,The Guardian 发了一篇不大不小的新闻:OpenAI 的安全主管离职了,临走前说公司内部文化是「broken」。

HN 上这条帖子 172 分,不算炸裂。但如果你往前翻两年的记录,会发现这不是第一次。

2024 年 5 月,OpenAI 有一位高级研究员出走,理由是「公司把闪亮产品放在安全前面」。

2024 年 9 月,Sam Altman 离开了 OpenAI 的安全委员会。

现在,2026 年 10 月,安全主管走了,说了同样的话。

「三次。两年。同一批关键词。」

这不是巧合。这是一个结构性矛盾,被时间反复验证。

01

METAPHOR

安全团队不是「刹车片」

大多数人对 AI 安全的理解,来自一个很朴素的比喻:速度越快,越需要刹车。安全团队的角色就是刹车片——在产品冲得太猛的时候踩一脚。

这个比喻听起来合理,但它错了一个根本的地方。

刹车片是附属于车的。它不是车的一部分,它只是加在车上的一个组件。按照这个逻辑,安全团队应该永远处于从属地位:产品团队负责造,安全团队负责检查。出了问题再修,出了风险再挡。

但 AI 不一样。

AI 系统的风险不是事后才发现的。模型在训练过程中就已经产生了行为倾向,这些倾向在产品发布之后才暴露出来。

等你发现「哦这个功能有风险」,模型已经部署了,用户已经用了,舆情已经发酵了。

也就是说,刹车片必须在车造出来之前就被设计进去。不是加上去的,是长进去的。

OpenAI 的安全团队一直夹在这个矛盾里。他们被要求「在产品安全问题上发声」,但发声的时机、渠道、话语权,从来不在自己手里。

02

CULTURE

「broken culture」到底指什么

Guardian 的报道里,安全主管用了「broken」这个词。

The Atlantic 的同题报道标题更直白:「I Quit OpenAI Because Its Culture Is Broken.」

这两个词都不是空话。

AI 公司的「文化」有一个具体体现:当安全团队和产品团队意见不一致时,最后听谁的。

这不是 OpenAI 独有的问题。Anthropic 当年发布 Claude 3.5 Sonnet 时,内部也有过类似的争论——是否要在速度和安全之间做 trade-off。

Ilya Sutskever 留任 OpenAI 本身就带着一层戏剧性:他曾经是安全派的代表人物,后来走了,又回来,回来之后又似乎在重新调整位置。

这种人事变动本身就是一种信号。安全团队的核心人物进进出出,说明这个岗位在公司内部的权力结构里本身就是不稳定的。

「「broken culture」指的是:安全评估不是决策的输入,而是决策的装饰。」

安全报告可以写得很漂亮,风险评估可以做得很完整。

但最终拍板的还是产品负责人。

安全团队的意见如果和产品节奏冲突,通常会被「延后处理」——这个词在 AI 公司里出现得越来越频繁,几乎是安全团队的墓志铭。

03

WHY HARDER

为什么这个问题越来越难

2024 年的时候,还有人觉得 OpenAI 的内部争论是「成长中的烦恼」。模型能力还在爬坡,安全问题还没那么紧迫,公司还有时间去调整结构。

但现在,情况变了。

第一个变化:模型能力过了临界点

2024 年,Agent 还在早期探索阶段,大多数使用场景是可预期的。

2026 年,Agent 已经开始在真实世界里做真实的操作——写代码、调 API、控制系统。

这意味着一次部署事故的影响,从「模型说错话」变成了「模型真的改了东西」。

第二个变化:竞争格局

OpenAI 的市场地位已经被 Claude、Gemini、Llama 等多个玩家蚕食。

在这样的高压竞争环境下,「慢一点、稳一点」从来不是一个有说服力的商业理由。

安全团队的每一个「再等等」,都被竞争对手当作进攻的弹药。

第三个变化:监管收紧

美国联邦法官在 10 月初裁定 Flock 属于「无差别大规模监控」,这是 AI 监控领域的一个重要判例。

虽然 Flock 不是 OpenAI 的产品,但这个判决释放的信号很清楚:AI 应用的合规成本正在快速上升。安全团队如果早一年发声,公司现在可能就不用面对这些诉讼。

三个变化加在一起,意味着 OpenAI 现在面临的不是「要不要加强安全」的问题。

而是「安全团队在过去两年里发出的声音,为什么没有人听」的问题。

04

BIGGER PICTURE

这不是 OpenAI 一家的事

把 OpenAI 的安全团队离职当作一个孤立事件来看,会错过更重要的东西。

这个问题存在于几乎所有主流 AI 公司。

Anthropic 有「宪法 AI」的框架,但框架再好,执行权还是在产品团队手里。

Google DeepMind 有独立的 AI 安全实验室,但 Google 整体的产品逻辑决定了安全研究的优先级。

Microsoft 和 OpenAI 的合作关系,也让微软的安全立场变得尴尬——它既是 OpenAI 的最大投资人,又是应该为 OpenAI 安全问题发声的董事会成员。

更广泛地说,这是一个所有高速发展的行业都会遇到的问题:当增长速度超过治理能力时,治理部门会被系统性边缘化。

金融行业的合规部门、药企的安全部门、互联网平台的内容审核团队——它们都经历过类似的挣扎。结果是,每次出事之后,治理部门获得的权力会短暂上升,然后随着热度消退慢慢回落。

AI 行业目前就处在这个循环里。每一次安全事件发生,人们就说「我们需要更多安全投入」。

投入确实增加了。但增加之后的权力结构没有变。

安全团队依然是附属部门,依然只在危机之后才获得关注,依然无法在产品发布的早期阶段拥有否决权。

∞

EPILOGUE

一个没有答案的问题

OpenAI 的安全主管走了。她会去哪家?会做什么?这些问题现在都不重要。

重要的是,她的离开不是终点,而是一个提醒:AI 行业还在用 2023 年的组织模式,跑 2026 年的技术速度。这个错位不会自己解决。

下次再有人问「AI 安全谁来负责」,也许答案不是「某个团队」或「某项规定」,而是「谁有足够大的权力,在产品发布之前说『不』」。

这个问题,OpenAI 还没有回答。

相关学习资料