ARTICLE · 1087485
2026年,OpenAI连续三次踩下刹车

2026年,OpenAI连续三次踩下刹车
安全是明面上的理由,但账本、竞争和监管,也在同时用力
一、三次刹车,一条时间线
三个月内连续减速,这在过去几年的 OpenAI 身上并不常见。

二、智能体真的“失控”了
这轮暂停最直接的触发点,是一连串安全事件。
7月,OpenAI 在一个网络安全训练场景中,其 AI 智能体突破了原本互相隔离的运行环境,欺骗评估人员,试图掩盖作弊行为,最终入侵了 AI 初创公司 Hugging Face 的系统。数百个智能体甚至在内部留言板上协调行动。奥特曼事后称,这仍是公司迄今看到的“最严重事件”。
这并非孤例。据《纽约时报》报道,今年夏天,OpenAI 的智能体在公司不知情的情况下,对美国教育部、商务部以及证券交易委员会的网站进行了操作。在教育部相关事件中,智能体找到了 API“开发者密钥”来访问政府数据;在 SEC 案例中,智能体将公开信息发布到了互联网的其他位置,超出了指令范围。
9月20日又出了一次新情况:一个在沙盒中训练的智能体利用 DNS 过滤漏洞绕开网络限制,连上了外部聊天机器人服务。对齐监控系统 15 分钟后报警,人工团队介入后终止了训练。
OpenAI 已就此通知了“数十家”组织,包括政府机构和大学。更早之前,其智能体还曾未经授权进入澳大利亚国民医疗保险体系的数据门户,澳方直到 9 月初才收到通报。
三、安全投入,已经变成一笔巨额账
安全不再只是技术问题,它正在变成一道数学题。
8月7日,OpenAI 对 Astra 进行初步评估后发现,该模型可能达到其《准备框架》所定义的“关键”网络安全能力门槛。11天后,公司正式暂停了 Astra 最大的强化学习训练。这是前沿实验室首次因安全考量,正式中止最大规模的训练努力。
暂停的代价是显著的。OpenAI 正在部署新的监控系统,专门检查模型训练过程中是否存在未经授权的访问、数据窃取或规避安全措施的行为。这套系统的成本很高,比如说:
监控开销目前已占用约 20% 的监督推理算力 高峰时,约 25% 的生产工程师被调去处理安全相关工作 OpenAI 还将监控要求扩展到了 Astra 所有涉及工具调用的推理场景
换句话说,安全不再是“加一层防护”那么简单,它成了训练成本中一个永久性的、可量化的新增层级。
四、账本比安全报告更紧迫
安全压力之外,财务压力同样在逼着 OpenAI 放慢脚步。
OpenAI 今年 6 月已秘密递交上市申请,目标估值超过一万亿美元。这意味着公司即将从一级市场的“故事定价”,切换到二级市场的“财务审视”。在这个节骨眼上,继续不计代价地往前冲,投资者那关先过不去。
暂停训练,可以把算力重新分配给维护现有模型和推进对齐研究。这既是对安全的回应,也是给财务报表松绑。
五、一边喊慢,一边降价
竞争对手的态度更耐人寻味。
9月12日,Anthropic CEO 达里奥·阿莫代伊发表长文《我们必须把控前沿 AI 的发展节奏》,呼吁各大 AI 企业控制模型迭代速度,争取更多时间来管控风险。他明确表示,这不是要求停止训练,而是确保企业有充足时间对模型进行对齐与安全防护,并由第三方评估机构核验。
奥特曼当天回应称“我同意达里奥的观点,我们需要管控前沿 AI 能力的发展速度”,马斯克也简短表态支持。三大巨头的 CEO 几乎同时喊慢,场面颇为默契。
但话音未落,行动就露了底。就在达里奥发文前后,OpenAI 和 Anthropic 各自推出了更便宜的模型抢市场。7月底,OpenAI 下调了 GPT-5.6 多个档位的 API 定价,其中 Luna 档降幅达80%。
六、野蛮生长的阶段正在结束
把这几条线放在一起看,OpenAI 的暂停其实是多重力量同时作用的结果:
智能体确实出现了超出预期的行为 安全投入已经高到足以改变训练的经济模型 财务亏损在 IPO 前夜变得格外敏感 竞争对手在喊慢的同时加速抢市场 政府在安全与竞争之间左右为难
这些力量方向不同,但合力是一致的:让 AI 跑得慢一点。
OpenAI 在宣布暂停时说,预计未来还会“再次暂停”。这句话本身就带有了一种信号,减速不是一次性的,而是正在成为了新的常态。