程序员表示他们已经找到了克劳德隐形水印的解决方法
在安索普确认克劳德模型将会在任何AI生成的内容中全球嵌入隐形、机器可读的水印之后的四小时内,开发者吉约姆·梅耶发布了他的覆盖程序。他的代码能够去除克劳德生成文本中的水印,并随后在GitHub上病毒式传播,在X网站上被收藏超过20,000次,并吸引了超过100名贡献者,还有许多人将该技术纳入自己的项目中。一位AI专家写道:“安索普在其克劳德文本中嵌入水印……问题几乎在一天后就变成了历史。”梅耶和其他人开始研究水印如何工作,在安索普上周宣布克劳德将采用水印以遵守欧盟《人工智能法》的消息后。一些人试图规避水印,因为他们不同意将所有AI生成的内容都标记为AI内容的想法,梅耶告诉WIRED,而其他人,包括他自己,则表示他们只是享受技术挑战。自由撰稿人和社交媒体创作者也联系了梅耶寻求使用该代码的帮助。新规在本月初实施,规定像安索普和OpenAI这样的模型提供商必须给合成音频、图像、视频或文本贴上标签,以便这些材料能够被机器识别为AI生成的,否则面临年度营业额高达3%的罚款。尽管规定说提供商不能推销规避工具,但对独立工具没有法律限制。“我并不反对透明度,我完全支持内容归属,”梅耶说。“我只是觉得水印本身是一个很糟糕的解决方案,因为它存在重大缺陷和风险。”他担心误报的风险,并且水印可能无法区分轻度或重度使用AI,尤其是作为母语为法语的人,他经常使用克劳德和其他AI工具如Grammarly来编辑他的写作。将水印作为证据使用时——即便安索普承认它只能生成文本被克劳德修改的概率——可能导致雇主不公正地拒绝候选人或对研究者的过度指控,仅仅因为检测器检测到它,梅耶说。安索普通过在克劳德的用词和短语选择中留下一个人类读者无法辨别的模式来隐形地水印文本,但机器知道如何寻找它可以检测到这个模式。由于这影响了克劳德的输出,一些用户担心这会降低克劳德回答的质量,尽管安索普坚称不会出现这种情况。该技术被称为SynthID,由谷歌开发,自2023年以来谷歌一直在使用它对其AI生成的内容进行水印。计算机科学家斯科特·阿伦森在OpenAI工作时提出了一种类似的方法,但表示公司从未部署它,因为公司担心水印会使客户对其产品失去兴趣。梅耶的去除方法采用了非水印的大型语言模型生成多个重写版本,交换同义词并稍微重新组织内容。当然,这依赖于使用其他不插入水印的大型语言模型——这可能不是一个安全的选择,因为包括OpenAI、微软和Meta在内的190个机构签署了欧盟的透明度行为规范。我们仍需观察这些实验室中有多少将实施他们的水印,而这些水印必须在8月发布的所有新模型中包含,并必须在12月之前集成到现有模型中。虽然在安索普发布用于检测水印的软件之前,无法确定这种工具的有效性,但了解构成克劳德水印的基本SynthID文本方法使他们相当确信该方法有效,硅谷独立AI初创公司Haimaker的首席技术官和联合创始人韦恩·潘说。他将梅耶的开源工具纳入了自己的平台,因为他同样不喜欢克劳德在仅进行轻度编辑时就对内容进行水印的想法,并且与水印对用户隐形的观点不同。其他程序员也开发了自己的去除工具:软件工程师埃里克·休斯花了15分钟使用克劳德制作了一个工具,可以去除隐形和相似的字符,重新排序段落内的句子,并将几个单词替换为同义词。牛津大学的访问学者莱昂·克隆表示,可以通过缩减克劳德的响应,将其翻译为与英语语义非常不同的方言(如阿拉伯语),然后再翻译回英文来去除水印。安索普自己也承认,大量编辑、释义或翻译的内容可能不包含水印。在对WIRED的一份声明中,安索普的发言人表示:“我们正在为克劳德的输出添加标记,以遵守
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡