Anthropic 给 Claude 输出内容全面加水印:文本隐形标记 + 文件数字签名
Anthropic 日前宣布,已从 8 月 2 日起在全球范围内部署一套机器可读的内容标记机制,覆盖 Claude 所有产品线。这是该公司为遵守欧盟《AI 法案》第 50 条签署的透明度行为准则的一部分,但执行范围不限于欧盟。
这套机制包含两层设计。第一层是文本水印。Claude 生成文字时,会在文本中嵌入人眼不可见的隐形水印,不影响阅读体验和内容质量。该水印具有"跟随性"——即使用户将内容复制粘贴到邮件、文档或博客中,水印依然存在;即便经过一定程度的编辑修改,也可能被保留。
第二层是文件元数据。当 Claude 生成 SVG、PNG、JPG 等文件时,会附加符合 C2PA 标准的数字签名元数据。C2PA 是由 Adobe、微软、Google 等公司共同推动的内容溯源开放协议,OpenAI 和 Google 的图像生成工具也已采用该标准。
此次标记方案的覆盖范围相当广泛。API、Claude 官网、Claude Code、Claude Cowork、Claude Tag 等产品线均适用。通过 AWS、Google Cloud 或 Microsoft Foundry 调用 Claude 时,文本水印同样生效,但文件元数据的支持情况取决于各云平台的功能适配。
值得注意的是,Claude 此前并未公开部署过文本水印。OpenAI 虽曾开发相关方案,但始终未上线。Anthropic 此次直接在文本层面落地水印,在大模型厂商中属于较早的一步。
对于普通用户而言,这意味着用 Claude 起草的邮件、报告、文章等,都会携带可被机器检测的水印。Anthropic 表示正在开发配套检测工具,未来也将支持第三方检测。
不过,该机制存在明显局限。检测到水印仅能说明内容"可能经过 Claude 处理",无法确认 Claude 为原始作者——毕竟大量用户仅将其用于润色、翻译或总结已有内容。反之,检测不到水印也不代表内容非 AI 生成:文本经大量改写后水印会消失;过短文本信号不可靠;文件经过格式转换或截图也会丢失元数据。
8 月 2 日之前发布的现有 Claude 模型,Anthropic 正在补充标记功能,具体时间表尚未公布。基于 Claude API 构建产品的开发者,Anthropic 建议其独立评估欧盟《AI 法案》第 50 条的合规要求。