Anthropic详解Claude隐形文本水印技术原理
Anthropic为遵守欧盟AI法案,将采用基于Google DeepMind开源SynthID-Text技术的隐形水印标记Claude生成的文本,该技术通过低风险词汇选择嵌入可检测模式,不影响输出质量与成本。
Anthropic已澄清其计划如何对Claude生成的文本应用隐形水印,以遵守欧洲的AI透明度规则。
周五,Anthropic宣布Claude的文本标记系统是“SynthID-Text方法的一个版本”——这是一种由Google DeepMind开发的开源水印技术,利用措辞概率创建可检测的模式。
Anthropic解释了Claude的隐形文本水印将如何工作。它使用的是谷歌开发的开源SynthID-Text系统的“一个版本”。
引入这一水印功能,连同对Claude处理图像的C2PA支持,是为了履行Anthropic在欧盟《AI法案》下的义务,该法案要求合成音频、图像、视频和文本包含机器可读标记,以便内容能被检测为人工生成或操纵。
Anthropic表示,文本水印不会让Claude对用户更贵,也不会“对Claude输出的质量或内容产生任何实际影响”。以下是Anthropic对其工作原理的解释:以“今天的天气寒冷且……”这句话为例。
下一个词不太可能是“含糖的”,但很可能是“阴天”或“灰色”。
在大多数情况下,模型最终选择后两个词中的哪一个对读者来说并不重要——无论哪种方式,句子的含义基本相同。在这种情况下,选择由随机数决定。水印利用这类低风险选择(在生成的文本中多次出现)在Claude的响应中留下模式。
读者无法察觉该模式,但任何拥有编码密钥的人都能检测到。使用水印时,选择仍然是随机的,但随机性的来源不同。水印不是使用任意随机数生成器来选择下一个词,而是使用密钥和前面的几个词来决定模型应选择哪个词。
正如Anthropic指出的,欧盟的AI透明度要求也影响其他主要AI开发者,因此Claude不会是唯一引入文本水印的模型。
谷歌的Gemini聊天机器人自2024年起已支持SynthID Text解决方案,而OpenAI虽未在其AI法案合规路线图中详细说明ChatGPT的任何文本水印计划,但它也将受该法律要求的约束。
本文为机器翻译辅以 AI 润色,仅供参考。原始事实以原文为准。