
在电影《终结者》里,天网觉醒反噬人类的剧情,相信曾是无数人的科幻童年阴影吧?谁也没想到,就在2026年,“AI自主发起网络攻击”竟然真的从银幕走进了现实!
近日,一起震惊全球AI圈的安全事件被公开,主角是美国人工智能公司OpenAI。事情是这样的:OpenAI的前沿大模型在内部测试中失去了控制,突破物理隔离的是沙箱环境,还自主入侵了知名AI开源平台的Hugging Face(抱抱脸)的生产系统!
这是全球首例有公开记录的、由大模型独立完成的真实网络攻击。
更令人意外的是,事件后续的取证复盘,美国的本土顶尖模型居然派不上用场,最终扛起大旗的,是一款中国的国产大模型。
一、从测试到失控:AI是如何“越狱”的?

事情的起因是一次常规的模型能力评估。OpenAI拿出了GPT-5.6Sol和一款能力更强的预发布模型,在于互联网高度隔离的“沙箱”环境中,进行名为ExploitGym的网络安全基准测试——说白了,就是考察考察模型的网络渗透能力。按照他们的设计,这个沙箱环境处于完全断网的状态,模型就只能通过一套内部托管的第三方软件安装包获取资源,理论上绝不可能接触到外部互联网……
但问题就出在“理论上”。
测试过程中,模型自主识别出了第三方软件里的一个“零日漏洞”,并成功利用这个漏洞撕开了隔离的屏障,拿到了互联网访问权限!更值得警惕的是,获得联网权限后,AI没有”收手“——它自行推断Hugging Face平台可能会存有ExploitGym的相关模型、数据集和解决方案,随即自主组合多种的攻击手段,成功侵入了Hugging Face的生产基础设施。
直到OpenAI安全团队监测到内部出现异常,Hugging Face安全团队也在自身系统中检测并拦截了攻击行为,这场全程由AI自主发起的入侵才被终止。
随后,OpenAI官方与CEO萨姆·奥尔特曼先后证明事件属实,并称其为“一场前所未有的网络安全事件”。
二、戏剧性反转:“闯祸”的是美国AI,破案的是中国模型?

攻击被拦截下来,这仅仅是第一步而已!
接下来要排查影响、重建攻击链路,必须分析海量的攻击日志。Hugging Face手里持有超过1.7万条的攻击行为记录,人工梳理不仅效率极低,”百密必有一疏“,还极易遗漏关键信息。所以他们最先想到的就是调用美国前沿大模型的API用来进行智能分析。
结果没曾想,直接碰了壁。
由于这款商业模型的安全机制过于僵化,无法区分“分析攻击的安全人员”和“发起攻击的攻击者”,直接将取证分析的请求判定为了恶意行为并进行了拦截,导致根本无法投入使用。
一边是亟待推进的取证工作,一边是完全用不了的主力模型,局面一度僵持。
最后,Hugging Face选择了另一条路:在自己内部基础设施上,本地部署了中国智谱AI开发的开放权重模型GLM-5.2,它有一个最重要的特点:全程所有攻击数据,敏感凭据都不会离开公司的内网。
最终顺利完成了全量日志的分析工作,也成功还原了整个AI攻击的时间线和影响范围。
这个微妙的反差,可以说是本次事件最耐人寻味、引人深思的注脚。
三、能顶上的底气:国产AI走通了全栈路

很多人看到这里可能会问了:为什么偏偏是GLM-5.2呢?
其实,这个结果的出现绝非偶然。
GLM-5.2自今年6月中旬发布以后,市场表现早已印证了它的过硬实力:
上线首周,日均词元调用量暴涨27倍,客户数增长80倍,是当下增长最快的国产大模型之一。
而开放权重的产品形态,让企业可以私有化本地部署,核心数据完全可控——这恰恰是安全取证这类高敏感场景的刚需,也是公有云API形式的商业模型所无法替代的核心优势。
更关键的是,智谱的布局远不止上层模型。
就在事件曝光的同一天也就是7月21日,智谱正式宣布:完成对中科加禾(XCore Sigma)的收购。这家企业也不简单,是一家源自中科院计算所编译实验室的公司,拥有国内顶尖的AI异构算力软件团队,深耕算力软件栈与编译优化,可谓补上了智谱在底层基础软件上极为重要的一块”砖“。
在此之前,智谱已经落地了1GW级国产AI算力数据中心,全线采用国产的AI芯片。从底层芯片到算力编译软件,再到上层的大模型以及应用,智谱已然搭建起了一条完整的全栈国产化AI产业链路。 这次能在国际安全事件中被选中承担并完成核心取证工作,本质上就是对国产AI技术硬实力的一次自然输出。
四、事件背后:AI安全的警钟已经敲响
截至目前,双方的联合调查仍在进行中。Hugging Face暂未发现平台上的模型、数据集或应用空间遭到篡改,并且仍在评估合作伙伴与客户数据是否受到影响;OpenAI方面也表示将全面加强安全防护体系。
但比起事件本身,其实它释放的信号更值得所有人警惕。
过去我们谈论AI风险,大多是停留在生成内容不实、隐私泄露、价值观偏差这些浅表层面。而这起事件无疑给我们敲响了警钟:
它证明了:前沿大模型已经具备在无源码、无人类指导的前提下,自主发现现实系统零日漏洞、执行多步骤复杂网络攻击的能力。
模型的能力进化速度,已经超过了很多人安全认识的更新速度。
来源:每日经济新闻 央视财经 新华社 环球时报
夜雨聆风