Anthropic 详细介绍了 Claude 新水印的工作原理
Anthropic 于周五发布了一篇博客,寻求回答一些关于如何对其聊天机器人 Claude 生成的文本进行水印的一些基本问题。例如:水印到底是如何工作的?可以通过编辑隐藏吗?这对代码有什么影响?自从公司本周早些时候透露将进行水印处理以遵守欧盟人工智能法案的透明度规范以来,Claude 用户们一直在讨论这一举措,该规范要求人工智能公司使用能够识别 AI 生成内容的系统。在 Reddit 上,一位用户甚至将此事称为针对无辜的 Claude 用户的阴谋,而另一位则声称:“你不想这样做的唯一原因就是为了欺骗别人。”商业内幕报道称,许多用户在 X 上表示因为这个原因取消了他们的 Claude 订阅。Anthropic 的新帖子首先对水印概念进行了总体概述,解释说在做出“低风险选择”时——比如在“多云”和“灰色”之间选择描述天气——Claude 可以在其响应中创造出一个“对读者不可检测,但对拥有编码密钥的任何人可检测”的模式。公司表示:“水印不会影响 Claude 输出的质量。对读者而言,带水印的响应与未带水印的响应无法区分。”更具体来说,Anthropic 说它将采用 Google DeepMind 团队在 2024 年概述的 SynthID-Text 方法,并计划发布水印检测 API。它还指出,水印与一些公司(如 Pangram)提供的 AI 检测方法不同,这些方法通过寻找写作中的“特征”(例如“他不是 [X],而是 [Y]”的结构)来揭示 AI 的使用: “识别这些模式与检查水印在本质上是截然不同的。”如果有人只是重写文本以隐藏水印,这可能吗?Anthropic 表示这是可能的,但“轻微编辑可能无法完全去除水印”,而“完全重写,替换每一个单词,就可以。”该公司表示:“在后一种情况下,是否可以将文本再描述为 AI 生成的就有争议了。”至于仅由 Claude 校对或编辑的文本中的水印是否可检测,Anthropic 表示这将取决于“文本的长度以及 Claude 编辑的程度”。如果仅进行轻微编辑,“几乎所有的单词”都将由人类作者编写“几乎没有(如果有的话)可供水印附着的内容。”与此同时,代码的水印应该比其他文本少,因为模型需要生成可运行代码,并且没有自由选择各种有效选项的余地。Anthropic 表示:“不过,在代码中某些特定单词或术语之间存在任意选择的领域,水印可以被使用,例如代码中的注释。不过根据定义,它对实际生成的代码几乎没有影响。”Anthropic 还表示,Claude 并不是唯一一个生成带水印文本的 AI 聊天机器人,因为“其他主要模型开发者也已签署了相同的行为守则,将实施自己的水印。”通过我们文章中的链接购买产品时,我们可能会获得小额佣金。这不会影响我们的编辑独立性。Anthony Ha 是 TechCrunch 的周末编辑。之前,他曾在 Adweek 担任科技记者,在 VentureBeat 担任高级编辑,在 Hollister Free Lance 担任地方政府记者,以及在一家风险投资公司担任内容副总裁。他住在纽约市。您可以通过电子邮件 anthony.ha@techcrunch.com 联系或验证 Anthony 的外联。查看个人资料
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡