中国开源AI,发现了600亿美元工具的漏洞
一个中国AI模型,在上线后不久,就在一款美国编程编辑器里找到了严重安全漏洞。
这款编辑器叫Cursor,不久前刚被SpaceX以600亿美元收购——可以说是当下全世界最值钱的代码工具。而发现漏洞的,是Z.ai(即智谱)刚刚发布的GLM-5.3。
据路透社报道,这是一个拥有7430亿参数的开放权重模型。上线第一天,它就干了一件让整个行业侧目的事。
我反复看了三遍这条新闻,脑子里冒出一个问题:一个刚出厂的"锁匠",怎么一上手就撬开了全世界最贵的"门锁"?
当锁匠开始撬锁
我试着用大白话解释一下这件事的分量。
据Z.ai官方技术报告,GLM-5.3在网络安全基准CyberGym(网络安全评测平台)上取得了84.5%的漏洞发现率,超过了OpenAI(即AI实验室)的GPT-5.6 Sol(83.6%)和Anthropic(即AI安全实验室)的Mythos 5(83.8%)。
这三家代表了全球AI的最高水平。而Z.ai的模型是开源的,权重向公众开放。
在我看来,这件事的意义超越了一个简单的跑分排名。过去几年,AI行业的潜规则是:最尖端的网络安全能力,一定藏在最封闭的闭源系统里。就像一个造锁世家,绝不会把核心图纸挂到门口。但GLM-5.3打破了这个默契——造锁的人,同时把开锁的钥匙摆上了展台。
7430亿参数的代码审查员
7430亿参数,这个数字本身就够唬人。但真正让我印象深刻的,是它干了什么。
据Z.ai官方博客披露,GLM-5.3在269个开源代码库中发现了2436个真实软件缺陷。其中一些漏洞可以追溯到1981年——它们在各种系统里藏了四十多年,没被任何人类审查员揪出来,却被一个AI模型翻到了底朝天。
在编程基准Terminal Bench 3.0和Agents' Last Exam上,GLM-5.3均拿下开源模型最高分。
更让我关注的是漏洞利用推理能力。据ExploitBench(漏洞利用推理评测基准)测试,GLM-5.3的得分为54.4%,是上一代模型的两倍。坦白说,这个绝对值不算高,但它衡量的是模型能不能像黑客一样思考——不仅找到锁的弱点,还能推演出怎么拧开它。目前这项能力仍低于顶级闭源系统,但翻倍的增长速度让人不得不警觉。
Cursor里的不速之客
GLM-5.3上线后,据多家科技媒体报道,它在Cursor中发现了一个严重安全漏洞。
我个人的感受有些复杂。Cursor是硅谷最热门的AI编程编辑器,被SpaceX以600亿美元收购后,身价堪比全球最大的科技公司之一。一个来自中国的开源模型,在全球最主流的编程工具里找到了安全问题——这件事本身就充满了戏剧张力。
一方面,我为中国AI的技术能力感到骄傲。从技术角度看,这证明GLM-5.3的代码审计能力已经达到了实战水平——不是在实验室里刷分,而是在真实产品环境中发现了真实漏洞。
但另一方面,这份骄傲里掺着一丝不安。一个最清楚防盗门弱点的人,往往就是那个装锁的师傅。当造锁的能力越来越强,我们对锁的依赖是否也该重新审视?
给模型加一把安全锁
Z.ai显然也意识到了这个问题。
据官方公告,GLM-5.3的开放权重设置了两星期的安全评估延迟期——模型发布后,不是立刻把所有能力全盘托出,而是留出一段观察窗口。同时,敏感功能被限制在一个叫"可信访问"的框架内,只有经过审核的使用者才能调用。
在我看来,这相当于给新造出来的锁配钥匙时,不是见人就发,而是先核验身份、登记用途。这个做法在开源社区里并不常见,说明Z.ai自己也在能力和安全之间寻找平衡点。
绕了个大圈子,AI在安全领域走了一圈——从帮人写代码,到帮人找漏洞,再到帮人理解漏洞可能被如何利用。能力的边界一直在外扩,但围栏也得跟着往外修。
开源锁的悖论
我一直觉得,开源模型在安全领域有一个结构性悖论。
开源意味着透明。任何人都能看到模型的架构、权重、训练方式。好处是,全球的安全研究者可以审查模型行为,发现潜在风险。坏处是,攻击者同样能研究模型的能力边界,找到最优的攻击路径。
这就像把安防系统的蓝图公开了——好人拿着蓝图加固自家门锁,坏人拿着同一份蓝图研究怎么撬锁。闭源模型看起来更安全,但只是因为没人看得清里面在发生什么。一旦出了问题,最先发现的往往是攻击者而非防御者。
锁匠越透明,门锁整体越安全,但撬锁的技艺也同步精进。GLM-5.3的发布,把这个悖论推到了聚光灯下。
同一把钥匙,两扇门
这是我最想聊的部分。
同一种能力,天然具有两面性。一个能在269个代码库中发现2436个漏洞的模型,可以帮助安全团队在黑客动手之前堵住缺口,也可以被恶意使用者拿来制造更精准的攻击武器。
84.5%的漏洞发现率,放在防御者手里是一面盾,放在攻击者手里就是一把矛。
在我看来,Z.ai设置的两星期安全评估延迟和"可信访问"框架,是一个务实的折中。它无法完全阻止恶意使用,但至少给防御方争取了时间窗口——先让好人拿到钥匙,坏人就得晚一步进门。
一个观察
中国AI公司在网络安全领域站到了全球前沿,这件事本身已经足够重要。但更重要的问题或许是:当锁匠造出了全世界最精密的锁,我们如何确保钥匙始终握在正确的人手里?
我的判断是,未来三年,AI安全领域的真正竞争,不在于谁能造出更强的锁,而在于谁能建起更可靠的门禁制度。能力是矛和盾的共同体,决定胜负的从来不是矛有多锋利,而是持盾的人站在哪一边。
夜雨聆风