Anthropic本周宣布,其旗下AI模型生成的文本和文件将统一添加水印,以便用户识别内容是否来自AI。此举也有助于该公司遵守欧盟关于AI生成内容透明度的相关法规。

欧盟《AI生成内容透明度行为准则》要求AI系统提供商和部署方告知用户其正在与AI交互,并在AI内容中嵌入水印。此外,用户在接触深度伪造内容、情绪识别及生物特征分类工具时,也必须获得相应提示。

水印技术起源于13世纪的意大利,但AI内容水印与传统水印截然不同。AI系统可自动在文本中嵌入标记,表明内容来源于AI而非人类。这些标记可以是词间距、数字间距、词序排列或其他不可见信号,即便用户将文本复制粘贴到其他平台,标记依然保留。读者无法察觉这些标记,但计算机系统可以识别。

Anthropic表示,2025年8月2日及之后发布的Claude模型将支持水印功能,涵盖通过API、Claude、Claude Code、Claude Cowork及Claude Tag创建的内容。水印将适用于所有Claude生成的内容,不限于欧盟地区。Anthropic表示,未来将公布水印检测的具体细节。

Claude将在其生成的文本及.svg、.png、.jpg等图片文件中嵌入水印。文本水印以不可见信号的形式嵌入字母和词语中,即使通过Windows记事本或macOS文本编辑器等工具复制粘贴,水印依然存在,人工编辑也未必能将其消除。

"水印将在模型层面应用,这意味着无论内容来自哪个Claude产品或界面,水印都将存在。"Anthropic表示。

Claude生成的图片文件将包含经过签名的来源元数据,记录图片的来源、创建者及是否经过修改等信息。若有人试图篡改元数据(例如隐藏AI生成的事实),加密签名将随之失效,从而向读者表明文件已被篡改。

AI透明度正成为行业趋势。Substack与Pangram合作,帮助读者了解文章中AI生成内容的比例;Suno近期也宣布推出相关功能,让听众识别AI创作的音乐;LinkedIn允许用户举报疑似AI生成的内容;Spotify推出的AI Persona功能,则帮助听众和创作者识别AI参与创作的音乐。

Anthropic在公告中也作出了说明:内容中存在水印,并不代表该内容完全由Claude生成;同样,没有水印也不代表Claude未参与其中。

例如,若有人将他人文章输入Claude并要求改写,输出内容会带有水印,但文章的事实和细节来源于原作者而非AI。Anthropic指出,用户经常使用Claude进行校对、翻译和摘要等工作。

此外,若有人将Claude生成的内容与其他文本混合编辑,即便最终文稿中只有少量内容来自Claude,也可能带有水印,这在一定程度上可能影响读者对文件可信度的判断。

Anthropic还指出,Claude生成或处理的内容有时可能不含水印,原因包括:AI生成内容占比过少,或内容经过"大量编辑、改写、翻译或与其他文字混合"。图片同样存在类似情况,例如对图片截图后另存为新文件,元数据将不会保留。

尽管Anthropic致力于遵守欧盟规定,但据部分报告显示,AI检测的准确性仍有待提升——例如,非英语母语者撰写的内容常被误判为AI生成。

Q&A

Q1:Claude水印是如何嵌入文本的,读者能看到吗?

A:Claude的文本水印以不可见信号的形式嵌入字母和词语中,普通读者无法察觉,但计算机系统可以识别。即使将文本复制粘贴到其他平台或文本编辑器,水印依然保留,人工编辑也未必能将其消除。

Q2:Claude图片文件的水印和文本水印有什么不同?

A:图片文件采用的是经过加密签名的来源元数据,记录图片的来源、创建者及修改情况。若有人试图篡改这些元数据,加密签名会随之失效,从而表明文件已被篡改。但如果对图片截图后另存为新文件,元数据将不会保留。

Q3:有了水印,是否就能确认内容是由Claude生成的?

A:不能完全确认。Anthropic明确指出,存在水印不代表内容完全由Claude生成,没有水印也不代表Claude未参与。例如,用Claude改写他人文章会产生水印,但内容本身来自原作者;而大量编辑、改写或混合其他文字后,水印也可能消失。

CNET