返回

文章详情

Anthropic defends and explains its AI watermarking feature

Anthropic 为其 AI 水印功能辩护并进行解释

Business Insider2026年8月14日 21:25

Anthropic 为其 AI 水印功能辩护并进行解释 由 Stephen Council 撰写 你目前正在关注这个作者!想取消关注吗?通过电子邮件中的链接取消订阅。在旧金山的 Anthropic 开发者大会上,一张海报宣传了其 Claude 产品。由于新的水印,Anthropic 正在努力安抚大家。这家公司在本周更新了其 Claude 模型的支持页面,透露了其将 AI 生成的文本标记为 AI 生成的计划。这引发了 Claude 用户的担忧,Anthropic 在周五发布了博客文章,为这项技术辩护并进行了解释。它还概述了这一工具的局限性。这家 AI 实验室的文章首先明确一点:它正在对文本进行水印处理,以遵守欧盟的 AI 法案,而其 AI 提供商同行——很可能是指 OpenAI——也将不得不这样做。像其他 EU 技术法规一样,AI 法案的影响超越了这个大陆。Anthropic 在其文章中表示,它“在全球推出时应用水印,因为我们目前没有一种持久的方法来按地区进行管理。”水印将首先应用于新的 Anthropic 模型,然后在接下来的几个月中应用于较旧的模型。之前,一些客户告诉《商业内幕》,他们因新的水印而取消了 Claude 订阅。Anthropic 告诉《商业内幕》自宣布水印以来,并没有看到取消趋势的上升。OpenAI 没有立即回复《商业内幕》的评论请求。两周前更新的支持页面表示,该公司还计划在文本中添加水印。Anthropic 的新水印工具实际上是如何工作的?Anthropic 在其文章中花费了数百个字回答一个基本问题,该问题在公司首次透露其水印计划时浮出水面:如何在一系列单词中嵌入 AI 的证明而不破坏聊天机器人的人性化语气?该公司引用了一篇 2024 年 Google DeepMind 的论文,该论文确立了 Anthropic 现在将应用于其 Claude 产品输出的水印技术。其工作原理如下。当 Anthropic 的 AI 模型生成句子时,它们会对包含哪些单词做出一系列决定。很多决定是随机的——一个面带微笑的孩子可以是“快乐的”或“兴奋的”,所以其中一个单词会被随机数生成器选择。Anthropic 将其水印描述为本质上是一种不同类型的随机数生成器——如果你有一个“密钥”,你就可以检测文本是否遵循 Claude 细微的选择模式。尽管 Anthropic 还没有发布“密钥”,但表示将提供一个名为应用程序编程接口(API)的工具,允许用户和第三方自行检查文本是否具有 Claude 的水印。水印不包括任何隐藏字符、奇怪字体或秘密文本。它仅仅是单词选择。Anthropic 表示,读者将无法区分这种差异。是否这意味着将 AI 生成文本与人类写作混淆的时代结束了?不。Anthropic 的博客文章反复指出了水印技术的局限性。Anthropic 的“密钥”将指向 Claude 的参与,而不是 AI 的一般性。文章中写道,“使用我们的密钥,仅能回答‘它可能部分是由 Claude 写的可能性有多大?’”较长的段落更容易被“密钥”识别为 Claude 生成的,因为模型会做出更多的单词选择决策。文章还表示,“事实性段落”中,错误选择可能危及准确性,将收到较少的标记。对于 AI 生成的代码也是如此。Anthropic 写道,由于代码是如此精确,水印不会那么频繁地应用于代码——错误的术语可能意味着软件无法正确运行。一些客户之前告诉《商业内幕》,他们担心水印会暗示他们不是文本或代码的作者。Anthropic 表示,水印的出现表明 Claude 处理了内容或文件,并不会改变用户在其条款下对文本的权利或拥有权。人们会多么频繁地检查 AI 生成的文本,以及这些新水印是否会导致与 Claude 输出之间不同的关系,这仍是一个开放的问题。“轻微编辑可能不会完全去除水印;完全重写,每个单词被替换,将会去除,”文章中写道。“在后者的情况下,当然可以争辩说该文本是否还能被描述为 AI 生成。”有线索?通过电子邮件联系此记者,地址为 scouncil@businessinsider.com,或通过短信、Signal、Telegram或WhatsApp联系,号码为 415-757-8198。使用个人电子邮件地址、非工作 WiFi 网络和非工作设备;以下是我们安全共享信息的指南。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡