🌐 English 即时比分

Anthropic披露Claude新水印机制更多细节

人工智能 来源: TechCrunch 发布时间: 热度: 👍👍
Anthropic披露Claude新水印机制更多细节
🤖
🤖

核心导读

Anthropic发布博文详细解释Claude文本水印的工作原理:采用Google DeepMind的SynthID-Text方法,不损害输出质量,任何持有密钥者可检测;轻度编辑无法完全去除,彻底重写则难称AI生成;代码水印影响甚微。该公司此举是为遵守欧盟AI法案透明度准则,尽管引发部分用户抗议,但主要模型开发商也将跟进。

Anthropic周五发布了一篇博客文章,试图解答有关其聊天机器人Claude生成文本将如何添加水印的一些基本问题,例如:水印机制实际如何运作?能否通过编辑隐藏?以及对代码有何影响? 本周早些时候,该公司透露将采用这一水印机制以遵守欧盟《人工智能法案》的透明度准则,该准则要求人工智能公司使用能够识别AI生成内容的系统。自那以来,Claude用户一直在对此举争论不休。 例如,在Reddit上,有发帖者称这是针对无辜Claude用户的阴谋,而另一人则声称:“你不想要这个功能的唯一原因就是想对人撒谎。”据Business Insider报道,已有“数十位”X平台用户声称因此取消了他们的Claude订阅。 Anthropic的新文章首先概述了水印概念,解释称当Claude在做出“低风险选择”时——例如用“阴天(overcast)”还是“灰色(grey)”来形容天气——它可以在回答中创建一种模式,这种模式“读者无法察觉,但任何拥有编码密钥的人都能检测到”。 该公司表示:“水印不会影响Claude的输出质量。对于读者而言,带水印的回复与不带水印的回复没有区别。” 更具体地说,Anthropic表示将采用Google DeepMind团队在2024年提出的SynthID-Text方法,并计划发布水印检测API。它还指出,水印技术与Pangram等公司提供的AI检测方法不同,后者通过寻找文本中的“破绽”(例如“这不是[X],而是[Y]”的句式)来识别AI生成内容:“识别这些模式与检查水印有着本质区别。” 有人能直接重写文本以隐藏水印吗?Anthropic表示这有可能,但“轻度编辑可能无法完全去除水印”,而“逐词替换的彻底重写则可以”。 “当然,在后一种情况下,这段文字是否还能被称为AI生成,是值得商榷的,”该公司表示。 至于仅由Claude校对或编辑过的文本中是否能检测到水印,Anthropic表示这取决于“文本长度以及Claude编辑的幅度”。如果只做了轻度编辑,“几乎所有词语”仍由人类作者撰写,“水印几乎(或完全)没有可附着的内容。” 与此同时,代码中的水印应该比其他文本更少,因为模型需要生成可运行的代码,没有自由在多种同等有效的选项中做任意选择。 Anthropic表示:“话虽如此,在代码中某些特定词语或术语存在任意选择的地方,可以使用水印,例如代码中的注释。但根据定义,它将对实际生成的代码产生微不足道的影响。” Anthropic还表示,Claude不会是唯一生成带水印文本的AI聊天机器人,因为“其他主要模型开发商也已签署同一份实践准则,并将实施各自的水印方案。”
分享这篇文章: