
5月22日,公安部悄悄放出了一份征求意见稿。
文件名叫《公安机关电子数据取证规则(征求意见稿)》,62页,61条。大多数人扫一眼标题就划走了。
但如果你关注AI,特别是智能体的法律边界,这份文件值得你认真读一下。
因为它在第五章里,写了这么一句话:
为了查明案情,解决案件中应用程序功能分析、人工智能生成信息识别等专门性问题,应当指派、聘请有专门知识的人进行鉴定,或者委托公安部指定的机构出具报告。
翻译一下:AI生成的东西,可以鉴定了。
"AI写的东西"和"人写的东西",以后有地方鉴定了
你可能会想,AI生成的信息怎么鉴定?2023年不是就出了个《生成式人工智能服务管理暂行办法》吗?
说实话,那个办法主要管的是服务提供者——你要标注AI生成内容、要搞投诉机制、别生成违法信息。核心思路是"源头管控"。
但执法机关这头,完全是空白。一个案子里出现了AI生成的聊天记录、AI写的虚假合同、AI伪造的音视频,公安拿到手之后怎么办?凭感觉判断?
没人给过答案。
这次终于给了。
而且给得挺硬——"人工智能生成信息识别"直接和"应用程序功能分析"并列,被定义为"专门性问题"。什么意思?就是说这不是普通警员能判断的活儿,得找专家鉴定,或者找公安部指定的机构出报告。
翻译一下:以后AI生成内容的鉴定,要像法医鉴定、笔迹鉴定那样,走专业程序了。
智能体时代,取证面临什么挑战
讲真,规则出台的背景很有意思。
2026年被业界称为"智能体元年"。国家网信办、发改委、工信部5月8日刚联合发了《智能体规范应用与创新发展实施意见》,把智能体定义为"具备自主感知、记忆、决策、交互与执行能力的智能系统"。
说白了,智能体不只是你问它答的工具。它会自己规划任务、调用工具、执行操作。
这就带来了一个很大的问题:
如果智能体在自主运行过程中生成了虚假信息、做出了侵权决策、甚至参与了违法犯罪活动——公安怎么取证?
举个真实的场景:有人用智能体批量生成虚假合同实施诈骗。几百份合同,每份都不一样。传统取证手段根本没法判断哪些是AI生成的、生成过程是怎样的。
再比如:智能体自动抓取网上文章重组后发布,涉及著作权侵权。你怎么证明这篇文章是AI拼凑的,还是人工创作的?
这都是以前没有的问题。
除了AI鉴定,新规还动了两个大手术
跟2019版比,这次有两个改动值得留意。
一个是适用范围。老规则只管刑事案件,这次连行政案件也一起包进来了。啥意思?不光是AI犯罪要取证,企业AI违规运营、AI数据泄露这些行政执法的场景,也得按同一套标准走。覆盖面一下子大了一圈。
另一个是电子数据本身的定义更新了。2019年那版列的品种挺古老的——"博客、微博客、贴吧"。今年变成了"公众号、直播间、短视频"。
而且加了几类以前没提过的东西:
系统日志、应用程序日志、网络流量日志 源代码和工具软件 用户操作记录、交易记录、通联记录
这仨看着不起眼,但全是AI智能体的命门。你要鉴定一段文字是不是AI生成的、一个决策是不是智能体做出的,绕不开这些底层痕迹。
但说实话,落地还差得远
规则给了方向,可你细想就觉得头疼。
鉴定标准在哪? 传统电子数据鉴定,哈希值一算、时间戳一验、元数据一扒,齐了。但AI生成的内容——一段话、一张合成图——你怎么证明它不是人写的?
市面上倒是有AIGC检测工具。人民网和科大讯飞搞了个AIGC-X,中文文本检测准确率号称90%以上。但问题来了:90%的准确率,放法庭上能当证据吗?万一那10%的误判正好落在你身上呢?
专家鉴定和机构报告,哪个更管用? 规则给了两条路:找专家鉴定,或者找公安部指定的机构出报告。但二者的法律效力有没有高低之分?法院认不认一样?压根没写。
最大的一个坑:AI输出怎么"保持原样"? 传统电子数据是静态的。一个文件,哈希值对上了,就说明没被改过。
但AI不同。同一个提示词,不同时间问同一个模型,结果可能完全不一样。(用过ChatGPT的人都知道,刷新一下答案就变了。)
智能体的输出是动态的、依赖上下文的、不可复现的。这种特性跟"取证"需要的"可追溯、可重现"几乎是矛盾的。
怎么解决?目前没人给答案。
方向定了,路还得慢慢走
这份稿子的反馈截止日是6月21号。按正常节奏,正式版估计下半年出来。
不管最后定稿怎么改,信号已经很清楚了——
AI生成的信息,正在从"技术圈的话题"变成"法律圈的议题"。
做AI产品的公司,以后智能体的日志留多久、输出能不能追溯、版本怎么记录,可能就不是"建议你做好"而是"你必须做好"了。
搞法律的同行,AI生成信息的鉴定方法和标准,早晚会变成基本功。
至于你我这样的普通人,记住一件事就够了:AI写的东西,以后有人能鉴定了。
倒不是什么坏事。有了标准,这事才真正能管起来。
夜雨聆风