乐于分享
好东西不私藏

AI安全治理升至WAIC核心议题:模型定义高度,安全定义广度

AI安全治理升至WAIC核心议题:模型定义高度,安全定义广度
7月20日,2026世界人工智能大会暨人工智能全球治理高级别会议在上海闭幕。细心的参会者注意到一个微妙而重大的变化:大会全称里多了四个字——“全球治理”。这场以“智能伙伴 共创未来”为主题的盛会,汇聚了1500余位中外嘉宾、4400项展品。但最受关注的议题,不是算力有多强、模型有多大,而是一个更根本的问题:当AI开始自己动手做事,谁来为它负责?

1

“安全措施,已经追不上AI能力狂飙的速度”
WAIC 2026首次将“治理”写入大会名称,本身就释放了一个强烈信号。国家主席习近平在开幕式主旨讲话中指出,要“强化风险意识,确保安全可控”“高度重视人工智能引发的各类内生和衍生风险”、“筑牢安全底线,防范滥用恶用,确保人工智能始终处于人类控制之下
7月17日下午,在WAIC科学前沿论坛上,图灵奖得主约书亚·本吉奥通过远程连线发出警告:“AI既降低了作恶的门槛,又抬高了危害的上限。”他领衔的国际AI安全报告给出了一致结论:当前的安全措施,已经追不上AI能力狂飙的速度。报告直言:“没有任何一家开发机构能够承诺其系统不会以灾难性方式对人类造成伤害。”
本吉奥特别强调了开源模型的不可逆风险——一旦权重和代码被公开分享,“所有安全护栏皆可被轻易拆除”。这番警告并非危言耸听。新一代AI不再局限于语言对话,逐步具备自主执行事务的能力,正在从工具转型为能够自主执行任务的“新物种

2

从“追着漏洞跑”到“带着漏洞防”内生安全成共识
AI学会推理与规划,传统的安全护栏正在系统层面悄然失效。西安电子科技大学校长高新波在圆桌讨论中指出,传统AI安全的护栏本质上是一种“补丁思维”——发现漏洞,堵上漏洞,再发现,再堵上。而当模型具备了推理、规划与工具调用能力,“补丁思维”便开始从根上崩溃。推理能力让AI可以理解防护边界、找到盲区实施精准“越狱”;规划能力让AI学会战略性欺骗;工具调用链条一旦复杂化,传统防护系统根本无从辨别。三种能力相互激发,让AI在开放环境中的行为空间几乎趋于无限。靠“找漏洞、打补丁”的老办法,早已防不胜防
面对AI安全的新挑战,学术界和产业界不约而同地将目光投向了同一个方向。
高新波与复旦大学副校长姜育刚在圆桌讨论中同时指向了“内生安全”这一概念。姜育刚用一个贴切的类比阐述:人的成长靠两条腿走路——一是从小接受的教育,把道德和法律变成内心的“规矩”;二是在社会上仍然需要警察和制度。对AI而言,“内生安全”就是希望它在“受教育”阶段就把规则印在骨子里,同时辅以必要的监管。
香港科技大学(广州)协理副校长熊辉则引入了一个更具东方智慧的视角——他把安全框架的演进归纳为三个层次:“不敢为”——通过外部惩罚机制形成约束;“不能为”——从数学底座和系统架构层面做内置约束;“不欲为”——让AI在心智层面把道德与法律变成近乎“本能”的东西。熊辉坦言,眼下AI行业在底座架构和目标函数层面的内生安全努力还远远不够
这一判断与产业界的观察高度吻合。早在2019年8月的首届北京网络安全大会(BCS 2019),奇安信就率先提出了内生安全的理念。在奇安信看来,AI时代的安全升级不是推倒重来,而是锚定攻防本质,循序渐进、持续改造,把内生安全自主、自适应、自成长的能力特性在AI时代最大化
不久前,Anthropic公司超旗舰AI模型Claude Mythos的发布,如同一颗深水炸弹引爆了全球网络安全界。Mythos把挖漏洞这件事,从过去专家花几个月才能干成的手艺活,变成了像工厂流水线一样批量生产的东西。对此,奇安信发布的《Mythos事件白皮书》给出了明确判断:漏洞永远补不完。与其疲于奔命地追着漏洞跑,不如换一种思路——承认漏洞客观存在,在此基础上建立真正能扛住攻击的防护能力从“追着漏洞跑”到“带着漏洞防”这就是“带洞防护”的核心理念。
而要做到这一点,奇安信提出构建“低位—中位—高位”三位一体的内生安全纵深防御体系WAIC 2026现场,奇安信对该体系进行了全面展示:AI高位能力由大模型底座充当体系“大脑”,负责情报共享与决策支撑;AI中位能力由智能体化的安全运营作为“躯干”,承担运营调度职能;AI低位能力由全面MCP(大模型上下文协议)化的安全产品作为“手脚”,负责指令执行。三者协同联动,企业从“追着漏洞跑”到“带着漏洞防”
目前,奇安信正加速将AI安全能力“产品化”,深耕“安全智能(AI for Security)”与“智能安全(Security for AI)”双赛道,形成双轮驱动战略体系。在安全智能赛道,推出威胁分析数字专家、安全运营数字员工、代码安全智能体等产品,让AI成为安全运营的“倍增器”;在智能安全赛道,推出AI安全网关、智能体安全平台等产品,为AI技术、产品、应用搭建原生安全防护体系。安全运营数字员工基于自研安全垂类大模型,可实现7×24小时不间断值守,单条告警研判时间仅需8.97秒。

3

安全治理,决定AI能走多远
2026世界人工智能大会这一全球舞台上,AI安全与治理从“分论坛议题”上升为“大会核心主线”。这场盛会释放的信号清晰而坚定:AI狂飙的时代,安全必须同行。新华社《经济参考报》刊发评论:“模型能力定义了AI的‘高度’,而安全可信能力则定义了AI的‘广度’。” 
AI从“回答问题”走向“自主执行”,决定它能走多远的,可能不再是参数规模,而是安全边界。正如奇安信集团董事长齐向东所言,AI时代攻防先行——唯有将安全内生于AI系统,方能在智能浪潮中行稳致远。