夜雨聆风学习资料网

ARTICLE · 1105062

终于可以证明AI偷的就是“我的声音”了

终于可以证明AI偷的就是“我的声音”了

AI 能克隆声音以后,“偷声”也成了内容生产里的一门生意。配音演员、知名人士,甚至只是声音好听的普通人,他们的声音都可能在本人不知情时,被拿去给视频配音、为产品引流。

但听得出“这是你的声音”,跟在法院证明“这是你的声音”,是两回事。对方不承认用了你的录音,训练材料又在它手里,怎么办?上海一中院审理的王女士案,把这件事往前推进了一步。

本案做对了什么

王女士是一名配音演员,平时在网络平台发布配音作品。2025 年 1 月,她从好友处得知,A 公司的一场推广活动疑似使用了自己的声音。她核实后,对相关音频进行公证并起诉。公司承认音频由自家 AI 生成,却否认使用了她的声音。问到投喂素材,公司称前员工已经离职,来源无法确认。

王女士首先需要证明,活动里的合成声能够指向自己。她通过司法鉴定,把公证固定的涉案音频与现场采集的本人声音进行比对。鉴定分析了 28 个共振峰声学指标,其中 24 个偏离度小于 10%;两者较为相似及高度相似的部分达到 90%。法院结合鉴定意见,认定两段声音高度相似,足以让公众与王女士建立特定身份联系,具有可识别性。

接着,还需要说明公司有没有可能取得她的声音。王女士提交的作品曾在公开网络平台发布,公司存在获取其声音的渠道和可能性。

公司掌握原始训练数据,比王女士更有条件说明投喂了什么、素材是否合法、是否利用了她的声音特征。但公司没有充分举证,法院因此认定其应当承担举证不能的不利后果。

这个案件真正重要的地方也在这里。权利人不需要凭空钻进对方的模型和数据库里,把整个训练过程从头还原一遍。先证明“这个声音能够识别到我”,再证明对方存在获取和使用自己声音的可能。此时,真正掌握训练材料的一方,就需要对声音来源作出合理说明。

之前维权难点在哪里

 AI 声音维权带来的第一个困难,是相似的声音怎样对应到具体的人。两个人可能有相近的声线,配音演员也会随角色调整发声方式。法院需要判断的,不只是“听起来像不像”,而是合成声能否让一般公众或者一定范围内的公众识别本人。相似度报告可以提供帮助,但样本怎么选、方法是否可靠、数字究竟能说明什么,都可能发生争议。

成都“孟某配音包”案(成都铁路运输第一法院一审,〔2024〕川7101民初8969号)就卡在这里。配音演员孟某发现,自己的声音被做成了 AI“配音包”对外销售。公司否认克隆原告声音,称使用的是开源或合法授权数据。公开评析记载,双方提交的声纹比对报告结论不同,法院最终没有据此认定合成声具备可识别性,驳回了原告请求。

而在其他维权成功的案例中,被告都主动承认使用了原告享有权益的声音。全国首例 AI 声音侵权案——殷某桢案(殷某桢诉北京某智能科技公司等,北京互联网法院〔2023〕京0491民初12142号)里,配音演员的录音被开发成 AI 拟声产品对外销售,公司直接承认使用了她的录音;杭州“梦某”案(杭州市滨江区人民法院〔2025〕浙0108民初666号)里,公司直接承认使用员工录制的声音素材,为虚拟角色“梦某”制作 AI 配音。

所以在上海王女士案之前,如果被告拒不承认使用了原告声音,证明“这是我的声音”就是原告举证的重点。

第二个困难,是最有可能解释来源的材料,通常不在声音主人手里。原告能固定产品输出,却很难自行取得训练数据、素材来源和调用记录。

此前维权成功的案件中,声音来源相对清楚。米哈游案(全称“米哈游诉某公司不正当竞争案”,上海市浦东新区人民法院一审)中,被告承认使用角色音频训练模型。

但声音来源清楚,也不代表使用就合法。殷某桢案说明,取得录音制品相关权利,不当然包括声音 AI 化许可;杭州“梦某”案说明,劳动合同里的知识产权归属不能替代人格权益授权。河南“AI 盗声”案中,寻求授权未果后继续使用,也影响了法院对过错的评价。

明星拜年视频和名人声音带货案,同时使用姓名、肖像和声音,所指对象更加直观。真正麻烦的,反而是只有一段匿名合成声的时候。没有脸,没有名字,甚至没有原来的台词。权利人首先得把这段声音和自己之间的联系证明清楚。

今后的影响

上海案提供的路径,可以与新的 AI 司法规则连起来看。《最高人民法院关于依法审理涉人工智能纠纷案件的意见》第 4 条,明确规制未经同意使用自然人声音训练、模仿其声音特征并生成可识别人声的行为。第 17 条则处理证据问题:控制证据的一方无正当理由拒不提交,法院可以依法作出不利认定;当事人不能自行取得关键证据时,可以申请法院调查收集。一个解决“什么样的 AI 换声可能侵权”,一个解决“关键证据都在对方手里怎么办”。

第 4 条强调的是“可识别性”这个结果。换脸、换声、AI 复活逝者、虚拟数字形象,都要看最终有没有生成能够识别到特定自然人的结果,以及有没有侵害相应人格权益。但 AI“撞脸”“撞声”这种偶然生成的相似结果怎么办,《意见》并没有直接给出结论。整份《意见》也在强调 AI 产品的工具属性:出了问题,要根据具体行为和损害后果判断责任,而不是先给技术本身贴上好坏标签。王女士案里法院认定的“可识别性”,落的就是这套标准。

当然,这也不意味着以后只要拿出一段声音说“像我”,就可以要求公司自证清白。权利人仍然需要先拿出证据,说明涉案声音能够识别自己,以及声音与被告行为之间存在联系。达到相应证明程度以后,法院才可以继续要求真正掌握材料的一方说明来源,审查其否认到底有没有依据。鉴定意见仍然需要结合样本、方法和其他证据审查,公司的举证义务也要放到具体争议和证据结构里判断。

对声音主人来说,以后的取证路径可以更加明确。先保存完整音频、产品页面和实际使用场景,再整理自己的原始录音、署名作品与发布记录;有必要时申请司法鉴定,并请求法院调查、责令提交或者保全由对方控制的训练素材、调用记录等关键材料。如果还要索赔,同类声音授权价格、历史许可费用等证据也要提前准备。

公司需要准备的和真人维权相对应。用真人声音之前,先确认授权是否覆盖 AI 训练、声音生成和具体使用场景;每个声源从哪里来、谁提供的、授权含不含训练和生成、哪份素材进入了哪个模型,都应该能够查清。这些要求最好从声源入库时就进入业务审批和供应商管理。真出了风险,也能够迅速找到对应素材,及时停用、停传。名人声音带货案(北京互联网法院〔2024〕京0491民初10085号)还说明,即使推广内容是委托第三方制作,实际使用这些内容的商家,也需要审核素材来源和授权情况。

当然,不同声音案件涉及的权益并不完全一样。“喜羊羊”案(重庆市渝中区人民法院一审)与米哈游案涉及角色声音的商业识别利益,沂水逝者视频案(山东省沂水县人民法院审结,判赔5万元)涉及死者肖像及近亲属利益。处理这些场景,还是要先分清谁在主张什么权益,不能看到“AI 克隆声音”几个字,就直接套用自然人声音案的结论。

但经过上海这个案件,一条越来越清晰的路径已经出现:先确认公众能否通过声音识别本人,再查声音的获取和使用证据、授权范围以及各方参与情况,最后确定责任与损失。

对产品团队来说,来源和授权记录从声源入库时就得留下。如果公司还像之前一样,试图用“无法证明”来搪塞过关,只能承担对自己不利的后果了。

【END】

本文由北京星也律师事务所于泽辉律师主笔ZCode 协助创作

作者简介

北京星也律所高级顾问

于泽辉

法律行业的AI创业者

All in AI+legal,用法律帮助AI创业,用AI重塑法律服务


「新朋友招募计划」

我寄offer与明月

只待将才共和鸣

详情指路:在继续成为的路上,我们想再找一位同行者 | 2026星也招聘律师助理

相关学习资料