夜雨聆风学习资料网

ARTICLE · 1042954

《人工智能安全治理框架 3.0》发布 AI 智能体迎来全新治理规则

《人工智能安全治理框架 3.0》发布 AI 智能体迎来全新治理规则

政策观察 · AI安全治理

《人工智能安全治理框架 3.0》发布

AI 智能体迎来全新治理规则

2026国家网络安全宣传周期间,全国网络安全标准化技术委员会(TC260)发布框架3.0,以风险分类分级为核心,构建覆盖AI全生命周期的综合治理体系。

导读

当AI从"对话工具"跃迁为能自主规划、跨工具执行的智能体,并借具身AI连通物理世界,安全风险的形态也在重塑。框架3.0承接1.0、2.0迭代升级,直面智能体与虚实联动的新型挑战,为产业合规与监管落地提供重要参考。

一、迭代背景:技术变革催生治理升级

从大语言模型对话交互,到AI智能体自主规划任务、跨工具联动执行,叠加机器人等具身AI打通数字世界与物理空间,人工智能能力边界持续拓展,风险形态同步发生深刻变化。

新涌现隐患

模型递归自优化带来的对齐失控风险、开源模型供应链污染、第三方插件调用不可控、AI技术被用于自动化网络攻击。原有治理规则难以覆盖虚实联动的新型风险场景。

治理思路——秉持包容审慎、敏捷治理,不搞一刀切管控,依托分类分级机制搭配监管沙箱,为技术创新预留容错空间。

二、五大治理原则,锚定AI治理方向

包容审慎、确保安全

鼓励创新发展,依托沙箱给予创新容错;一旦出现危害国家安全、公共利益、公民权益的高风险行为,及时处置阻断。

风险导向、敏捷治理

结合应用场景、智能等级、部署规模分级管控,动态感知隐患,实现随行伴跑式快速响应。

技管结合、协同应对

技术防护与管理制度并行;研发方、提供者、使用者厘清责任,形成政府监管、行业自律、社会监督协同格局。

开放合作、共治共享

推动国际治理共识,对接《全球人工智能治理倡议》。

可信应用、防止失控

坚守人类可控底线,防范目标漂移、自主行为脱离人工管控,保障AI可信落地。

三、风险分类:新增智能体、具身AI重点板块

框架将风险划分为内生安全风险应用安全风险两大板块,本次3.0最大亮点,是新增智能体、具身AI专项管控要求。

内生安全风险

聚焦模型底层隐患:训练数据污染投毒、对抗样本、后门、幻觉、对齐失效;算力与开源组件供应链安全;训练生成中的知识产权侵权。

AI智能体(Agent)风险【本次核心新增】

分配唯一身份标识,落实最小权限;高风险操作须经人工审批并留存日志;校验插件与外部工具来源;全流程审计监控,行为可观测、可追溯、可熔断,异常指令默认拒绝

具身AI风险

面向机器人、自动驾驶等实体AI,开展传感器抗干扰测试,上线前完成仿真与极端场景验证;强制配备急停、故障熔断,警惕集群AI连锁失控。

其他应用安全风险

网络安全——防AI用于攻击、内置安全护栏、必要时降级阻断;信息内容安全——动态过滤违法偏见、生成内容强制标识溯源、应急熔断、禁挖思想倾向;个人信息权益——告知同意、定期影响评估。

四、全生命周期管控,贯穿研发到下线

研发阶段

核验训练数据来源并脱敏,开展对齐训练与安全微调,组织红队测试,校验开源组件与第三方框架完整性。

部署上线阶段

完成风险分级评估,接口权限最小化;防范检索增强知识库投毒;智能体上线前于沙箱预验证。

运营阶段

安全日志留存不少于6个月,定期审计;搭建实时监控,设异常熔断、服务降级、人机复核,向用户说明能力边界。

下线退役阶段

关停服务、回收算力、清理残留数据与访问凭证,撤销第三方授权,归档记录,消除遗留风险。

五、多元治理机制,打通落地通道

三层安全评估体系

覆盖模型算法、通用应用、政务/医疗/金融等场景专项评估,引入红队、众测等测试手段。

重点行业安全基线

在政务、金融、医疗、教育、广电、应急等高影响领域细化AI落地安全标准。

监管沙箱机制

分行业分级准入、动态测试;探索无主观过错可控风险的责任豁免(故意致害除外),对中小企业、公共项目政策倾斜。

伦理审查机制

针对生命健康、公共秩序等高影响项目开展伦理审查,将伦理要求嵌入产品全生命周期。

人才建设

培养覆盖自动驾驶、脑机接口前沿领域的AI安全专业人才。

六、产业启示:企业合规实操要点

框架释放明确合规信号:安全管控不能仅局限于基础大模型,需重点补齐智能体、插件、第三方工具链的安全管理。

企业实操要点

①强化供应链安全,核验开源模型/组件/插件来源并跟踪漏洞;②严格收紧智能体权限,高危操作设人工确认,杜绝全自动高危动作;③全链路日志与审批记录留存满足6个月要求;④落地AI生成内容溯源标识;⑤分级评估,低风险轻量化、高风险强化,平衡创新与安全。

框架要点·一张清单

▸ 发布节点:2026国家网络安全宣传周,TC260正式发布▸ 核心主线:以风险分类分级构建AI全生命周期治理体系▸ 最大亮点:国内首个系统性针对AI智能体的治理参考框架▸ 新增管控:智能体身份标识/最小权限/人工审批;具身AI急停熔断▸ 底线原则:高危操作必须人工把关,监管沙箱预留容错空间

结语

从1.0聚焦基础内生风险,到2.0拓展衍生风险与可信伦理,再到3.0直面智能体与虚实联动挑战,国内AI安全治理体系持续迭代。框架以风险分级为主线,覆盖模型、智能体、实体机器人、软件供应链全链条,守住"高危操作必须人工把关"底线,在监管沙箱支撑下为产业创新划定安全红线。

资料来源:全国网络安全标准化技术委员会(TC260)《人工智能安全治理框架3.0》

元福科技

关注我们

了解更多政策资讯!

相关学习资料