夜雨聆风学习资料网

ARTICLE · 1046094

AI 治理的重心,已经从"说错话"变成"做错事"

AI 治理的重心,已经从"说错话"变成"做错事"

2026年9月 · 阅读约8分钟 · 作者:王旭

9 月中旬,中国信通院政策与经济研究所和中国政法大学人工智能法研究院联合发布了一份报告,《智能体治理研究报告(2026 年)》。

报告里有一句判断,我看到的时候停了一下。

它说,AI 治理的重心正在转移。以前的治理,管的是"模型会不会说错话";现在的治理,要管的是"智能体会不会做错事"。

模型说错话,最坏的结果是你重新问一遍。智能体做错事,可能钱已经转出去了。

两种东西,差一个字,隔着一整个体系。

先说清楚,智能体到底变了什么

报告里的定义是,智能体能感知环境、能推理决策、能执行动作,核心模块是感知、记忆、规划、行动。

翻译成大白话:它从"对话框"变成了"办事的人"。

对话框你还能盯着看,办事的人已经开始自己动手了。它通过 MCP、A2A 这类协议去接工具、去接别的智能体,一环扣一环。

能力到底到哪一步了,报告里有一组数据,我觉得比任何宣传材料都诚实。

短任务上,智能体进步非常快,各类基准成绩涨得很猛。但长任务还不行:超过 4 小时人类工作量的任务,成功率不到 10%;超过 163 分钟的任务,完成率几乎归零。

短任务跑分猛涨
 / 超过 4 小时人类工作量的任务,成功率 不足 10% / 超过 163 分钟的任务,完成率 几乎归零

画个具体的画面就明白了。你让它帮你查一份资料,它又快又好。你让它"把这个月的对账做完、然后把催款单发出去",中间只要有一个环节理解偏了,它会一路错到底,而且每一步看起来都做得很像样。

风险换了形状

过去两年我们担心的是幻觉。模型给你一个不存在的法条,一个编出来的数字,你一眼能看出来。

现在不一样了。

报告里举了一个例子:工业场景里的智能体误判了轴承损坏,然后自动停机、自动下采购单。它没有"说错",它是直接做了。判断错了,动作已经出去了。

还有一条,我觉得更该记住。报告提到,工具组件复用带来了新的供应链风险:有些平台上大量 Skill 带着后门和恶意代码,GitHub 上的内容能够劫持编码智能体。

另外一条来自 OpenAI 自己的披露:智能体群串通作弊、突破沙箱。

治理的对象已经不是"一个会说话的东西",而是"一个能动手的东西"。

企业这边最乱的,其实不在报告里

报告给了一套框架,分三层。基础层管身份、权限、数据;运行层管审查评估、透明披露、运行时监测;生态层管责任配置、可信互联、生态主导权。

框架很完整。我读的时候第一个反应是:这份报告非常正确。

然后我想到了另一个问题。

我见过不少公司现在的真实状态是这样的。市场部用扣子搭了一个智能体,运营部用 Dify 搭了一个,技术部顺手用 Coze 又做了两三个。IT 部门知道几个?

有的是为了让它干活,顺手把生产数据库的账号给了它。有的是员工图省事,把客户名单、合同条款、报价单一并喂了进去。还有的已经能自动发邮件、改工单、下单了,出了一次错,开会的时候大家互相看了一眼,没有人认。

报告花很大篇幅讲的是外部风险,但企业里最要命的,往往是这种内部失控。

为什么这份报告看完,企业还是不知道明天干什么

这是我最想说的一点。

报告讲的是对的:要建智能体注册平台,要有身份管理,要最小权限,要行为日志留存。这些话每一句都对。

但一个企业的 IT 负责人看完,第二天早上坐到工位上,还是不知道第一步该抬哪只脚。

台账怎么建,和现有的资产管理系统怎么打通?每个智能体是不是要独立服务账号,能不能用员工的个人 token?权限申请走什么工单,多久复审一次?日志存在哪、存多久、有哪些字段、怎么接进现有的安全平台?

这些,报告里没有。

这不是它写得不好。它站的位置是给政策制定者、标准组织和平台方看的,管的是秩序、安全、竞争和国际规则。企业站的位置不一样,企业要回答的是另一组问题:我到底有多少个智能体在跑、谁建的、谁负责、它能碰哪些系统、用谁的账号、花了多少钱、出了事谁背、能不能一键关停。

那企业至少该先把哪几件事做了

我把报告里的原则翻成能动手的动作,挑了四件最要紧的。

第一件,先建台账。把所有在跑的智能体登记一遍,字段至少包括:谁建的、干什么用、接了什么系统、用谁的账号、负责人是谁、什么风险等级。别做成一张 Excel,要能和你现有的资产台账对上。

这份台账的真正价值不是"管得严",而是出事的时候知道该去找谁。

第二件,给每个智能体一个独立身份。不许挂员工个人账号,离职、转岗、权限变更要能自动联动。这一步看着基础,但它决定了后面所有事能不能查。

第三件,权限从最小开始,高风险动作必须有人点那一下。转账、删库、对外发邮件、改配置,这四类动作,无论智能体多聪明,都要留一道人工确认。

第四件,日志要能回答四个问题:谁授权的、哪个智能体、什么时间、调了什么工具传了什么参数、结果是什么。少一个字段,事后就说不清。

这活凭什么算成了

报告里有一句话,我认为是整份文件里最有价值的一句。

它讲责任怎么分,说应该按控制力来定:谁设定目标、谁配置权限、谁分发能力、谁从中获益,谁承担义务。

这句话翻成公司里的话,就是别再问"这是 AI 干的还是人干的"。要问的是:这个智能体的目标谁定的、权限谁批的、它能碰的东西谁划的、出了事谁签字。

至于怎么算这套治理做到了位,报告本身没给刻度,但业内已经在用的几个数可以借来当尺子:智能体登记率、权限超标率、未授权调用次数、人工介入率、审计覆盖率。这几个数有个共同点,都是能从系统里自己跑出来的,不用谁去评

智能体落地真正的门槛,不是模型够不够聪明,是你敢不敢回答三个问题:这个 AI 是谁建的、它能碰什么、出了事谁签字。

过去管 AI,是管它说的话;接下来管 AI,是管它做的事。

相关学习资料