Anthropic公司于周五发布了一篇博客文章,详细解答了其聊天机器人Claude生成文本水印的相关问题。文章探讨了水印技术的具体实现方式、编辑是否能隐藏水印,以及水印对代码生成的影响。
自从Anthropic本周早些时候宣布将为其AI模型生成的文本添加水印,以符合欧盟AI法案中的透明度规定以来,Claude用户对此展开了激烈讨论。该规定要求AI公司采用能够识别AI生成内容的系统。
在Reddit上,有用户将此举视为对无辜Claude用户的阴谋,也有人表示“唯一不希望水印存在的理由就是为了欺骗他人”。据Business Insider报道,已有数十名用户在社交平台X上表示因此取消了Claude订阅。
Anthropic在新文章中首先介绍了水印的基本概念,解释称Claude在做“低风险选择”时(例如选择“阴天”或“灰色”来描述天气),会在回答中嵌入一种对读者不可见但持有密钥者可检测的模式。
公司强调,“水印不会影响Claude输出的质量。对读者来说,有水印的回答与无水印的回答没有区别。”
具体来说,Anthropic将采用Google DeepMind团队于2024年提出的SynthID-Text方法,并计划发布水印检测API。该公司指出,水印技术与Pangram等公司通过寻找写作中的“迹象”(如“这不是X,而是Y”)来检测AI生成内容的方法不同:“识别这些写作模式与检测水印本质上是两种不同的技术。”

对于是否可以通过改写文本来隐藏水印,Anthropic表示这有可能,但“轻微编辑通常无法完全去除水印”,而“彻底重写、替换每个词语则能去除水印”。
公司补充道:“在这种情况下,文本是否还能被称为AI生成内容本身就值得商榷。”
关于仅由Claude校对或编辑的文本是否带有水印,Anthropic表示这取决于“文本长度和Claude编辑的程度”。如果只是轻度编辑,“几乎所有词语仍由人类作者撰写,水印几乎无处附着”。
至于代码生成,水印的存在感会较弱,因为模型必须生成可运行的代码,无法在多个同样有效的选项中自由选择。
“不过,在代码中的注释等存在任意词语选择的部分,水印仍可应用,”Anthropic解释道,“但这对实际代码的影响微乎其微。”
此外,Anthropic还表示,Claude并非唯一会生成带水印文本的AI聊天机器人,“其他主要模型开发者也已签署同一行为准则,并将实施各自的水印技术。”


