Anthropic宣布将为Claude生成的文本和图像添加机器可读标记,以符合欧盟AI透明度法规。根据Claude支持页面的说明,"生成的文本将嵌入水印,生成的文件将在支持的情况下包含经数字签名的来源元数据。"这些标记对人眼不可见,但能帮助用户和在线平台识别内容是否由Claude模型生成。

这些更新属于未来承诺,并非即时生效。欧盟《人工智能法案》中的AI标注与透明度义务已于8月2日正式生效,对该日期前已上线的现有AI产品设有四个月的合规宽限期。因此,Anthropic表示新版Claude模型将从发布之日起即对AI生成内容进行标注,而现有模型的支持工作仍在推进中。

机器可读标记将在全球范围内应用于受支持的Claude模型,包括Claude Platform(API)、Claude、Claude Code、Claude Cowork和Claude Tag。目前采用两种不同的标注技术:对于Claude处理的图像,将对支持的文件应用C2PA——这一来源元数据标准已获Adobe、OpenAI和谷歌采用;而对于Claude生成文本的标注方式,目前披露的细节相对有限。

据Anthropic介绍,一种"不可感知的水印"被直接嵌入Claude模型生成的文本中,不会改变内容的含义、质量或可读性。Anthropic未透露该水印系统的名称,但表示通过AWS、谷歌云或微软Foundry访问Claude模型时,文本水印同样会被应用。

"由于水印是文本的组成部分,在文本被复制粘贴到其他地方时,水印也会随之传递,并可能在经过部分编辑后依然保留,"Anthropic在Claude支持页面上表示。"水印将在模型层面应用,这意味着无论通过哪个Claude产品或界面生成的文本,都将包含水印。"

Anthropic还致力于让用户和第三方能够检测嵌入Claude生成内容中的水印和来源元数据,并表示将在后续技术文档中分享检测系统的详细信息。目前已有多款工具可检测C2PA元数据,包括谷歌的Gemini,但尚不清楚这些工具是否适用于Claude生成的文件。

这是推动AI生成文本和图像在各大在线平台上实现清晰标注的又一重要举措,对于希望避免接触此类内容的用户而言也是一大利好。同人文学读者此前已自发搭建了较为初级的检测系统,用于标记AO3同人作品中使用Claude工具的情况,而这些标注系统的应用范围将更为广泛——前提是它们能够有效运作。

C2PA数据存在易被剥离的已知问题,有时甚至在媒体文件上传至在线平台时就会意外丢失;Anthropic文本水印方案的稳健性目前也尚不明朗。就连Anthropic自身也对这些标注系统的局限性持审慎态度,承认缺乏可检测标记的内容仍可能源自生成式AI模型。

Q&A

Q1:Anthropic为Claude生成内容添加水印的具体方式是什么?

A:Anthropic采用两种技术:对于图像,使用C2PA来源元数据标准;对于文本,则将不可感知的水印直接嵌入生成内容中。文本水印不会影响内容的含义、质量或可读性,且会随文本一同传递,即便经过复制粘贴或部分编辑后仍可能保留。

Q2:欧盟《人工智能法案》的水印要求何时正式生效?

A:相关义务已于2026年8月2日生效,但对该日期前已上线的现有AI产品设有四个月的合规宽限期。Anthropic表示,新版Claude模型将从发布之日起即应用水印,现有模型的支持工作仍在推进中。

Q3:C2PA元数据标准可靠吗?能否有效防止水印被去除?

A:C2PA存在易被剥离的已知问题,有时在文件上传至在线平台时就会意外丢失。Anthropic自身也承认这些标注系统并非万无一失,缺乏可检测标记的内容仍可能来自生成式AI模型。

The Verge