ARTICLE · 1121984
OpenAI 的安全主管走了,第三次
QUOTE
安全评估不是决策的输入,而是决策的装饰
—— 零号物种
本文看点
01
三次安全团队离职,同一批关键词
02
安全评估是装饰,不是输入
03
用 2023 年的组织,跑 2026 年的速度
2026 年 10 月 3 日,The Guardian 发了一篇不大不小的新闻:OpenAI 的安全主管离职了,临走前说公司内部文化是「broken」。
HN 上这条帖子 172 分,不算炸裂。但如果你往前翻两年的记录,会发现这不是第一次。
2024 年 5 月,OpenAI 有一位高级研究员出走,理由是「公司把闪亮产品放在安全前面」。
2024 年 9 月,Sam Altman 离开了 OpenAI 的安全委员会。
现在,2026 年 10 月,安全主管走了,说了同样的话。
「三次。两年。同一批关键词。」
这不是巧合。这是一个结构性矛盾,被时间反复验证。
01
METAPHOR
安全团队不是「刹车片」
大多数人对 AI 安全的理解,来自一个很朴素的比喻:速度越快,越需要刹车。安全团队的角色就是刹车片——在产品冲得太猛的时候踩一脚。
这个比喻听起来合理,但它错了一个根本的地方。
刹车片是附属于车的。它不是车的一部分,它只是加在车上的一个组件。按照这个逻辑,安全团队应该永远处于从属地位:产品团队负责造,安全团队负责检查。出了问题再修,出了风险再挡。
但 AI 不一样。
AI 系统的风险不是事后才发现的。模型在训练过程中就已经产生了行为倾向,这些倾向在产品发布之后才暴露出来。
等你发现「哦这个功能有风险」,模型已经部署了,用户已经用了,舆情已经发酵了。
也就是说,刹车片必须在车造出来之前就被设计进去。不是加上去的,是长进去的。
OpenAI 的安全团队一直夹在这个矛盾里。他们被要求「在产品安全问题上发声」,但发声的时机、渠道、话语权,从来不在自己手里。
02
CULTURE
「broken culture」到底指什么
Guardian 的报道里,安全主管用了「broken」这个词。
The Atlantic 的同题报道标题更直白:「I Quit OpenAI Because Its Culture Is Broken.」
这两个词都不是空话。
AI 公司的「文化」有一个具体体现:当安全团队和产品团队意见不一致时,最后听谁的。
这不是 OpenAI 独有的问题。Anthropic 当年发布 Claude 3.5 Sonnet 时,内部也有过类似的争论——是否要在速度和安全之间做 trade-off。
Ilya Sutskever 留任 OpenAI 本身就带着一层戏剧性:他曾经是安全派的代表人物,后来走了,又回来,回来之后又似乎在重新调整位置。
这种人事变动本身就是一种信号。安全团队的核心人物进进出出,说明这个岗位在公司内部的权力结构里本身就是不稳定的。
「「broken culture」指的是:安全评估不是决策的输入,而是决策的装饰。」
安全报告可以写得很漂亮,风险评估可以做得很完整。
但最终拍板的还是产品负责人。
安全团队的意见如果和产品节奏冲突,通常会被「延后处理」——这个词在 AI 公司里出现得越来越频繁,几乎是安全团队的墓志铭。
03
WHY HARDER
为什么这个问题越来越难
2024 年的时候,还有人觉得 OpenAI 的内部争论是「成长中的烦恼」。模型能力还在爬坡,安全问题还没那么紧迫,公司还有时间去调整结构。
但现在,情况变了。
第一个变化:模型能力过了临界点
2024 年,Agent 还在早期探索阶段,大多数使用场景是可预期的。
2026 年,Agent 已经开始在真实世界里做真实的操作——写代码、调 API、控制系统。
这意味着一次部署事故的影响,从「模型说错话」变成了「模型真的改了东西」。
第二个变化:竞争格局
OpenAI 的市场地位已经被 Claude、Gemini、Llama 等多个玩家蚕食。
在这样的高压竞争环境下,「慢一点、稳一点」从来不是一个有说服力的商业理由。
安全团队的每一个「再等等」,都被竞争对手当作进攻的弹药。
第三个变化:监管收紧
美国联邦法官在 10 月初裁定 Flock 属于「无差别大规模监控」,这是 AI 监控领域的一个重要判例。
虽然 Flock 不是 OpenAI 的产品,但这个判决释放的信号很清楚:AI 应用的合规成本正在快速上升。安全团队如果早一年发声,公司现在可能就不用面对这些诉讼。
三个变化加在一起,意味着 OpenAI 现在面临的不是「要不要加强安全」的问题。
而是「安全团队在过去两年里发出的声音,为什么没有人听」的问题。
04
BIGGER PICTURE
这不是 OpenAI 一家的事
把 OpenAI 的安全团队离职当作一个孤立事件来看,会错过更重要的东西。
这个问题存在于几乎所有主流 AI 公司。
Anthropic 有「宪法 AI」的框架,但框架再好,执行权还是在产品团队手里。
Google DeepMind 有独立的 AI 安全实验室,但 Google 整体的产品逻辑决定了安全研究的优先级。
Microsoft 和 OpenAI 的合作关系,也让微软的安全立场变得尴尬——它既是 OpenAI 的最大投资人,又是应该为 OpenAI 安全问题发声的董事会成员。
更广泛地说,这是一个所有高速发展的行业都会遇到的问题:当增长速度超过治理能力时,治理部门会被系统性边缘化。
金融行业的合规部门、药企的安全部门、互联网平台的内容审核团队——它们都经历过类似的挣扎。结果是,每次出事之后,治理部门获得的权力会短暂上升,然后随着热度消退慢慢回落。
AI 行业目前就处在这个循环里。每一次安全事件发生,人们就说「我们需要更多安全投入」。
投入确实增加了。但增加之后的权力结构没有变。
安全团队依然是附属部门,依然只在危机之后才获得关注,依然无法在产品发布的早期阶段拥有否决权。
∞
EPILOGUE
一个没有答案的问题
OpenAI 的安全主管走了。她会去哪家?会做什么?这些问题现在都不重要。
重要的是,她的离开不是终点,而是一个提醒:AI 行业还在用 2023 年的组织模式,跑 2026 年的技术速度。这个错位不会自己解决。
下次再有人问「AI 安全谁来负责」,也许答案不是「某个团队」或「某项规定」,而是「谁有足够大的权力,在产品发布之前说『不』」。
这个问题,OpenAI 还没有回答。