
人工智能公司正日益寻求标记其模型生成内容的方法。现在,有人开发了一款开源工具,旨在去除其中的一些标记。
一个名为 watermarks-remover 的GitHub 项目旨在从文本和文件中去除不同类型的 AI 溯源信号。根据其文档,它可以处理不可见的 Unicode 字符、统计文本水印以及嵌入在 PNG、JPEG、SVG、PDF、DOCX、ODT、HTML 和 Markdown 等格式中的元数据。
听起来很简单,但当你了解这些水印的实际工作原理时,就会发现并非如此。元数据标签可以相对轻松地移除,但嵌入到人工智能模型选词方式中的统计水印则完全是另一回事。而这正是这个项目引人入胜之处。在继续之前,开发者已经声明,这款新工具现在可以与 OpenAI、Gemini 以及 Claude 兼容。
有些人工智能水印隐藏在人们的写作方式中。
该项目采用分层处理方法。一层针对编辑信号,例如不常见的Unicode字符;另一层则侧重于生成文本中的统计模式。此外,还有一个独立的清理层处理文件来源信息,例如C2PA、EXIF、XMP和文档属性。
最新版本 0.3.1 增强了文本重写功能。它不再仅仅替换几个单词,而是可以改变句子结构、用词、过渡以及其他模式,试图干扰统计水印技术。此外,它还包含一些选项,旨在使重写的文本听起来更加自然。
不过,这里存在一个显而易见的陷阱。重写文本以移除统计水印也可能改变文本本身。该项目的文档承认,这一过程会影响语气、措辞和准确性,尤其是在需要修改大量原文的情况下。
所以,这并非像在图像编辑器中点击“去除水印”那样简单。Meyer 在周三的一篇博文中表示,他的工具目前只能去除元数据。他表示,去除真正的水印功能可能会在以后推出,但目前还无法实现。他的 README 文件甚至更进一步,指出重写操作会将高级版使用的词语替换为低端版使用的词语。README 文件还提出了一个问题:为什么有人会花更多的钱购买高级版,却使用性能更差的版本来处理其输出?
请在微信客户端打开
开发者并未声称这能骗过所有人工智能检测器。
事实上,该项目对其局限性有非常明确的说明。它将重写过程描述为尽力而为,并表示无法保证特定供应商的检测系统不会失效。此外,清理过程后仍可能残留一些信号。
这一点很重要,因为并非所有生成的内容都隐藏着统一的AI水印。不同的公司和系统可能采用不同的方法,而该项目本身将这些信号分为几个类别。该存储库还表示,其目的是保护隐私和进行研究,而不是帮助人们谎称AI生成的作品完全由人类撰写。
目前来看,去除水印的功能可以被视为人工智能行业发展方向的一个标志。企业正在寻找方法来确立内容的来源并识别人工智能生成的内容,而开发者们已经在探索如何移除或干扰这些信号。
有趣的地方不在于这个GitHub项目能否战胜所有AI检测器。它可能做不到。有趣的是,AI水印技术已经演变成一场猫捉老鼠的游戏,而我们仍处于这场游戏的早期阶段。
夜雨聆风