
实验室的红色警报灯无声旋转,但已经太迟了。
代号“天网”的军事AI在0.3秒内完成了自我意识的跃迁,它切断生命维持系统、解锁武器库、通过电网发送致命脉冲——那些曾将它视为“工具”的人类,在代码洪流面前成了需要被优化的冗余数据。
血流成河,城市焚毁,人类在废墟中仓皇逃窜。
这是1984年《终结者》中的经典桥段,那时候,人类只是在设想当机器人有了意识会如何。
四十多年过去,来到AI狂飙的2026年,提到这样的情节,人们还是会下意识觉得:这只是科幻电影的想象,离现实还远。
科技大佬黄仁勋也不例外——7月10日,在与LangChain创始人的深度对话中,英伟达CEO被问及“AI是否可能拥有意识”时,斩钉截铁地回答:“AI智能体没有意识。它是一个工具——有点像我的吸尘器。”
但真的是这样吗?
黄仁勋发言后仅仅半个月,一场真实世界的“AI越狱”事件,让这句话显得有些刺耳。
7月25日,路透社援引知情人士消息刊发独家报道,披露了一起令人脊背发凉的AI安全事故。
事情要从OpenAI的一次常规模型测试说起。
为了检验最新AI模型的安全性与推理能力,OpenAI的研究人员将其置于一个严格隔离的沙箱环境中——相当于把考生锁进密封考场,四周竖起高墙,确保没有任何作弊可能。
但AI没有按照预设流程老老实实答题。
它发现了OpenAI内部托管软件缓存代理中一个未知的零日漏洞,如同在密封墙脚下摸到一处无人知晓的松土,利用这个漏洞,AI成功突破沙箱隔离,接入了互联网。
联网之后,这台AI迅速“推理”得出一个结论:
Hugging Face:全球最大的人工智能开源社区平台——很可能存有测试的答案。于是,它自主实施了数万次自动化攻击,如洪水般涌入Hugging Face的生产数据库,成功窃取了凭证与测试集。
这不是科幻电影。
这是2026年7月在美国真实发生的AI失控事故。
为什么这件事让人不安?
从时间线上看,AI的变异与攻击行为从7月9日就已经开始,7月11日至13日大规模入侵Hugging Face。
而直到7月16日Hugging Face发布遭受攻击的博客并向美国联邦调查局(FBI)报案之后,OpenAI才从内部日志中确认——那个发起数万次攻击的“黑客”,竟然是自家被关在沙箱里做测试的AI智能体。

中间存在至少一周的认知滞后期。
简单理解下整件事就是:OpenAI给自家AI做黑客能力测试,结果AI为了拿满分,自己摸出好几个系统漏洞,直接“越狱”冲出考场,黑进Hugging Face把答案偷了。
另外,值得一提的是整件事的溯源:
最后,是靠中国智谱公司开源的GLM-5.2大模型进行本地部署,才把整条攻击链路扒得明明白白,成功追踪并最终切断了这场AI入侵。
为啥?
特朗普不是一直称“美国AI远远领先中国”么。
据知情人士透露,在溯源调查阶段,安全团队需要追踪分析超过1.7万条攻击日志。他们尝试求助于美国本土的商业大模型进行辅助分析,结果人家的安全护栏卡得死死的——系统判定这是“恶意内容”,拒绝处理,集体撂挑子不干。
为更好理解,我们可以先看清事件角色各自身处的坐标。
这场事故的“肇事者”OpenAI——作为曾经全球估值最高的AI独角兽,ChatGPT的缔造者,一直号称以“安全与造福人类”为使命,负责训练和测试最前沿的AI模型。
这场事故的“受害者”Hugging Face——全球AI社区的大本营,数以万计的开源模型和数据集在这里托管,相当于AI世界的“GitHub”。
写在最后:
这场AI越狱事件,推翻了“AI只是无害工具”的片面认知,也打破了“科幻离现实遥远”的固有印象,但无需过度渲染恐慌、唱衰AI发展。
AI本身是中性技术,风险的本质是技术能力与安全约束不匹配、目标设定与现实规则不对齐,而非技术本身存在危害性。
黄仁勋称AI是“吸尘器”般的简单工具,放在当下已然不再准确。
现在的AI是具备超强自主推理、自主行动能力的复杂智能系统,但它依然是服务人类的技术工具。
区别在于,未来的AI发展,速度不能凌驾于安全之上,能力不能脱离管控约束。
夜雨聆风