↑阅读之前记得关注 + 星标本号,每天才能第一时间接收到更新最近 GitHub 上一个去水印项目一路蹿红,直接给几家 AI 大厂刚吹起来的水印技术浇了盆冷水😂。就在上周,Anthropic 还刚发了长篇博客,把自家的文本水印技术吹得神乎其神,号称轻微修改根本无法清除。没想到才过去没几天,回旋镖就精准砸到了自己头上。
巨头们的水印,到底藏了什么玄机
很多人对 AI 水印的印象还停留在塞零宽字符的初级玩法 —— 往文本里插几个肉眼看不见的特殊字符,懂点代码的用正则表达式一秒就能清干净。但现在大厂用的早就不是这种小儿科了。以 Claude 采用的方案为例,它属于统计型文本水印,核心逻辑藏在大模型的选词概率里。大模型生成文本本质上是逐词 “接龙”,每选一个词都像掷骰子,从一堆候选里挑概率最高的。而水印技术就是偷偷把这颗 “骰子” 换掉,用官方密钥和上文内容生成的哈希值来决定选词。对读者来说,读起来完全通顺自然,文本质量也不受任何影响;但官方拿着密钥一比对,就能顺着选词的统计轨迹,立刻认出这是自家模型生成的内容。按厂商的说法,这种水印遍布全文的词汇分布里,改几个词、换两句话根本没用,只要不全篇重写,痕迹就一直存在。
这个项目能快速收获大量关注,本质上是戳中了全球很多用户的共同不满。事情的起因是欧盟 AI 法案的要求:在欧盟提供服务的 AI 产品,需要支持检测 AI 生成内容。但不少大厂的做法非常简单粗暴:既然没法精准区分不同地区的用户,那就给全球所有用户的输出都打上水印,哪怕是付费会员,也没有关闭该功能的选项。相当于欧盟的监管要求,最后让全世界用户一起买单。更让很多创作者不舒服的是逻辑的颠倒。AI 本质上是辅助创作的工具,就像以前的打字机、润色助手一样,最终的创作核心还是人。但强制水印的逻辑,变成了只要用过 AI 工具,作品就会被打上 “AI 生成” 的烙印,创作者反而要去证明自己的 “原创性”,工具反倒成了作品的 “烙印者”。有意思的是,还有网友试过让 Claude 自己运行这类去水印插件,结果被直接拒绝,哪怕用户明确说明是自己拥有版权的内容也不行。转头把同款插件装到其他大模型上,反而能顺利运行,属实是有点黑色幽默了。当然,目前所有的去水印方案都还属于尽力而为的级别。毕竟各大厂商的官方检测器和核心密钥都没有公开,没人能百分百保证可以完全绕过官方检测。但这也正是开源社区的有趣之处:你筑起高墙,我就搭起梯子。关于 AI 内容控制权的猫鼠游戏,显然还会一直演下去。你怎么看待 AI 强制加水印这件事?欢迎在评论区聊聊你的看法。