
过去两年,大模型打架的剧本几乎一样:发个新参数、刷个跑分、再发一篇“超越某某”的论文。可这次智谱发布GLM-5.3,画风突然变了——发布会的热搜,不是“参数多大”,而是一个冷门词:安全。

▲
图源:公众号@阿枫科技
GLM-5.3沿用743B的MoE基座,参数没怎么变,编程能力却较5.2暴涨约50%,在Terminal-Bench 3.0登顶开源第一;更让行业侧目的是,它在CyberGym网络安全基准上拿到84.5%,直接超过Claude和GPT-5.6。最戏剧性的是:因为网络安全审查,智谱决定暂缓全量开源权重,先上线平台、两周后再放权重。

一个“为了安全连开源都要缓一缓”的国产模型,却同时把安全跑分做到了全球最高——这个反转,恰恰是新游戏规则最好的注脚。
事件还原
提升50%
智谱AI于8月14日发布GLM-5.3,通过深度后训练实现双跃迁:编程较5.2提升约50%,Terminal-Bench 3.0登顶开源第一

安全基准超越Claude、GPT-5.6
CyberGym安全基准84.5%,超越Claude与GPT-5.6

发现超2400个漏洞
该模型已在269个真实项目中协助发现超2400个漏洞

科技创新价值

GLM-5.3释放了两个信号
Part.1
第一,大模型竞争进入“后训练时代”——参数、架构这些“底子”已经很难拉开差距,真正的胜负手变成谁能把同一块基座训练出更强的“实操能力”:写代码、修漏洞、当安全审计员。

Part.2
第二,安全不再是被动合规,而成了核心竞争力。2400个真实漏洞的发现量,意味着AI第一次能以“攻防工程师”的身份创造直接生产力——这比“会聊天”值钱得多。
城市与国家竞争价值
这条赛道恰恰是中国AI的“主场优势”。
美国大模型强在通用能力,但中国在大规模工程落地、安全合规治理上有天然的先发条件——尤其当网络安全、数据主权成为国家议题,一个“可信、能审计、能堵漏洞”的国产大模型,就是数字基建里的“安全基座”。

从城市层面看,北京是智谱的大本营,上海、深圳则围绕“大模型+安全”“大模型+工业”构建生态。国家层面,网络安全审查、AI安全基准的建立,正在把“安全能力”变成中国AI出海的硬通货。

当全世界都在为AI安全头疼时,谁先建立起“又强又安全”的标准,谁就定义了下一代AI的国际规则。
国产大模型的下半场,讲的是同一个词:安全。
▶
关注【未来科技窗】
用品牌的专业视角看科技江湖
Future Tech Window
编辑 / 菲姐
排版 / 包包
本文由未来科技窗整合发布

夜雨聆风