克劳德的新红字水印现在是隐形的——暂时
未达到标记?该标记标识任何克劳德处理过的内容,即使是他仅编辑过的人类写作。“看看那微妙的乳白色调。它的厚度恰到好处。哦,我的天,它甚至有一个水印。”来源:Aurich Lawson | 《美国精神病》 (狮门电影) “看看那微妙的乳白色调。它的厚度恰到好处。哦,我的天,它甚至有一个水印。”来源:Aurich Lawson | 《美国精神病》 (狮门电影) 安思科技(Anthropic)透露,它将很快为任何其模型处理(不仅仅是生成!)的内容加水印。在一篇支持文章中,安思科技解释说,它正在推出机器可读的水印,以遵守欧盟的AI法案,该法案要求所有AI系统提供者为AI生成或操控的音频、图像、文本和视频输出加水印。该法律适用于2023年8月2日之后发布的任何AI模型,并为提供者更新之前发布的模型提供了到2026年12月的宽限期。安思科技确认,未来所有全球提供的新模型——不仅限于欧盟——将“从第一天起”标记AI生成的内容。文本输出将“携带嵌入式水印”,用户无法看到,并且其他“生成文件将包括数字签名的来源元数据(在支持的情况下)。”安思科技表示,值得注意的是,安思科技正在采用“从轨道上将其摧毁”的方法,对所有支持的处理内容施加水印,尽管欧盟并不要求在AI系统执行“标准编辑的辅助功能”(该指南自己的例子是语法修正)的情况下,或者在不“实质性改变”用户文本或其含义的情况下这样做。应用于模型级别的水印无法区分大量生成与逗号修正,因此克劳德可能最终会标记法律旨在不干扰的内容。究竟它在水印的彻底程度上如何,直到安思科技发布可以测试的检测工具之前我们无法知道。该公司表示,计划最终分享如何检测标记的细节,以提供欧盟法律所要求的技术支持。安思科技还指出,水印不会在“不支持它们的一些平台或功能”上工作。对于非文本内容,安思科技将使用C2PA元数据方法记录来源。 绕过与误解都很简单 不幸的是,欧盟描述的方法以及安思科技实施的方法对不法分子来说非常容易绕过,同时可能会惩罚那些信任系统准确标记输出的用户。文本水印的工作原理是通过在整个文档中偏向模型的单词选择,只有通过正确的工具才能检测到聚合效应。问题是“隐形”也可能意味着模型偶尔会为了保持信号完整而用稍差的单词替代最佳单词。安思科技指出,这些标记“在文本被复制和粘贴到其他地方时会随文本一起传播,并可能在某些编辑中保持存在。”但如果带水印的文本粘贴到另一个编辑文本的聊天机器人系统中,水印可能会被销毁。对于图像和视频内容,截图/录制或使用任何合适的元数据编辑工具也足以删除该信息。一旦安思科技告诉全世界如何识别这些水印,建立一个删除水印的系统将是微不足道的。此外,误解的潜力似乎很高;水印并不是特别信息丰富。安思科技解释说,“检测到的标记提供了克劳德处理内容的信号,但不是完全确凿的。”安思科技还表示,标记传达的唯一真实信息是“内容可能已经被克劳德处理”,且标记甚至可能出现在不是由克劳德生成的内容上。更糟糕的是,公众可能并不了解处理文本与完全生成文本之间的区别。如果系统仅仅因为人类文本在接触克劳德的工作流中被编辑而标记人类创作的文本,那么它突然带有与完全生成文本相同的涵义。更糟糕的是在一个“未检测到标记并不意味着内容没有被AI生成或处理”的系统中,安思科技说。 克劳德可能标记更多AI内容,超出要求 对此,安思科技承认它可能正在标记一些法律并不要求标记的内容:“人们通常使用克劳德进行校对、翻译、总结或转换文件。即使基本思想、文本或数据源自其他来源,输出也可能携带克劳德标记。”因此,尽管法律明确豁免,但克劳德仍会标记对原始写作进行的任何编辑工作。如果水印成为克劳德使用的万用标记,从拼写检查到完全重写,安思科技的解决方案可能会通过以超出必要的方式标记内容,从而使用户感到沮丧,可能会无意中混淆来源。例如,教师或教授不该
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡