Anthropic近日就如何为Claude生成的文本添加隐形水印作出说明,以符合欧洲人工智能透明度法规的要求。Anthropic表示,Claude的文本标记系统采用的是"SynthID-Text方案的一个版本"——这是由谷歌DeepMind开发的一套开源水印技术,通过词语概率构建可识别的文本模式。
这一水印功能,连同针对Claude处理图像的C2PA支持,均是为了满足Anthropic在欧盟《人工智能法案》下的合规义务。该法案要求合成音频、图像、视频及文本须包含机器可读标记,以便识别内容是否由人工智能生成或经过处理。Anthropic表示,文本水印不会提高用户的使用成本,也"不会对Claude输出内容的质量或内容本身产生任何实质影响"。
Anthropic对其工作原理作出如下解释:
以"今天的天气又冷又……"这句话为例,下一个词不太可能是"甜腻的",但很可能是"阴沉的"或"灰蒙蒙的"。在大多数情况下,读者并不太在意最终选择哪个词——句子的含义基本相同。在这类情况下,选择通常由一个随机数决定。
水印技术正是利用这类"低风险选择"——它们在一段生成文本中会出现多次——在Claude的回复中留下特定模式。这种模式对读者而言完全不可见,但对于持有相应密钥的人来说是可检测的。启用水印后,词语的选择仍基于随机机制,但随机来源有所不同:系统不再使用任意的随机数生成器来选词,而是利用密钥以及前几个词来决定模型应选择哪个词。
正如Anthropic所指出的,欧盟的人工智能透明度要求同样适用于其他主要人工智能开发商,因此Claude并非唯一一个引入文本水印的模型。谷歌的Gemini聊天机器人自2024年起便已支持SynthID-Text方案,而OpenAI尽管尚未在其《人工智能法案》合规路线图中披露ChatGPT的文本水印计划,但同样须遵守该法律的相关要求。
Q&A
Q1:Claude的隐形文本水印是怎么工作的?
A:Claude采用的是谷歌DeepMind开发的SynthID-Text开源水印技术。简单来说,在生成文本时,面对多个意思相近的候选词,系统不再用普通随机数决定选哪个词,而是用一个特殊密钥结合前几个词来做选择,从而在文本中留下人眼不可见但可机器检测的特定模式。
Q2:添加水印会影响Claude的输出质量或收费吗?
A:Anthropic明确表示,文本水印功能不会提高用户的使用成本,也不会对Claude输出内容的质量或实际内容产生任何实质性影响。水印只是改变了词语选择时的随机来源,对最终呈现给读者的内容影响极小。
Q3:除了Claude,其他大语言模型也需要加文本水印吗?
A:是的。欧盟《人工智能法案》要求所有在欧洲运营的主要人工智能开发商为合成内容添加机器可读标记。谷歌的Gemini自2024年起已支持SynthID-Text水印方案,OpenAI虽尚未公布ChatGPT的文本水印具体计划,但同样须遵守该法案的相关规定。
