Anthropic近日宣布,将在Claude生成的文本和图像中嵌入隐形水印。
此举旨在使Claude符合欧盟《人工智能法案》的要求。该法案于2024年正式生效,其中包含一项名为"实践准则"的自愿性条款,Anthropic已签署该条款。该条款要求模型提供商对AI生成的内容进行标注。
文本水印方面,Anthropic表示将从8月2日之后发布的Claude模型开始实施,并计划后续将该功能扩展至早期版本。据悉,该水印不可见,且在文本被复制到其他应用程序后仍会保留,即便用户对内容进行编辑,水印也可能依然存在。
Anthropic未透露文本水印的具体技术原理。不过,谷歌DeepMind于2024年发布的一篇研究论文或许能提供参考线索——该论文描述了一种通过修改大语言模型的词语选择来使生成文本可被识别的技术,Anthropic的水印机制可能采用了类似方案。
DeepMind的水印技术(即SynthID)不仅支持文本,还覆盖AI生成的图像、视频和音频,目前已集成至谷歌旗下多项消费级AI服务中。Anthropic同样计划对Claude生成的媒体文件进行标注,涵盖JPG、PNG和SVG等图像格式。
图像水印方面,Anthropic将采用C2PA技术。该技术通过为AI生成的图像附加元数据文件来实现标注,元数据中记录了生成该图像所用的模型、生成时间以及适用的版权限制等信息,开发者还可自行添加其他详细内容。
C2PA内置多重防篡改机制:它会为每个元数据文件生成哈希值(即唯一标识符),以便快速发现任何改动;同时还能检测黑客试图整体替换元数据文件的行为。
Anthropic计划推出相关工具,帮助用户更便捷地识别Claude生成的内容,但同时也提醒用户,该技术并非万无一失——尤其对于较短或经过大量编辑的文本片段,水印检测可能并不总是准确。
在此之前,OpenAI同样签署了《人工智能法案》的自愿性"实践准则"。该条款已于上周正式生效,这意味着ChatGPT的开发商或将很快推出自己的文本水印机制。OpenAI曾于2024年开发过类似功能,并在C2PA联盟的指导委员会中占有一席之地。
Q&A
Q1:Anthropic为Claude添加水印的目的是什么?
A:此举主要是为了符合欧盟《人工智能法案》的要求。该法案包含一项自愿性"实践准则"条款,要求AI模型提供商对生成内容进行标注,Anthropic已签署该条款。
Q2:Claude的文本水印是如何工作的?
A:Anthropic未公开具体技术细节,但参考谷歌DeepMind的SynthID技术,推测其原理是通过修改模型的词语选择来使生成文本可被识别。该水印不可见,复制到其他应用后仍会保留,编辑后也可能继续存在,但对于较短或大量编辑的文本,检测效果可能有限。
Q3:Claude图像水印采用的C2PA技术有什么特点?
A:C2PA通过为AI生成图像附加元数据文件来实现标注,记录生成模型、时间及版权信息等内容。它内置防篡改机制,能通过哈希值检测元数据是否被修改,也能识别整体替换元数据文件的行为,安全性较高。
