最新消息:关注人工智能 AI赋能新媒体运营

Anthropic 为 Claude 输出添加隐形水印,AI 内容可追溯时代来临

科技资讯 admin 浏览

Anthropic 承诺全球嵌入 AI 内容标识,2026 年 8 月起覆盖所有 Claude 模型

Anthropic 宣布签署欧盟《AI 法案》实践准则,并计划于 2026 年 8 月起在全球范围推出的所有新 Claude 模型中嵌入内容标识机制。该措施不限于欧盟市场,将覆盖 API、Claude、Claude Code、Claude Cowork 及 Claude Tag 等全部产品线。现有模型虽获法律过渡期,但 Anthropic 称已在推进水印功能的回溯适配。

具体而言,Anthropic 采用双轨标识机制。文本输出将附加隐形水印,据称不影响内容含义与可读性,复制粘贴后仍可保留,"在一定程度编辑后"也可能存续。图像等文件则基于 C2PA 开放标准附加数字签名溯源元数据,可表明文件经 Claude 处理,并能揭示后续篡改行为。文本水印还将通过 AWS、Google Cloud 及 Microsoft Foundry 等云合作伙伴生效,不过这些平台或暂不支持签名元数据。Anthropic 计划后续发布验证工具,供用户及第三方检测。

水印技术存在固有局限

Anthropic 坦承该技术限制明显。检测到水印不意味着内容完全由 Claude 生成——用户常以 Claude 进行校对、翻译或摘要,输出可能携带水印但核心思想来自人类。反之,未检测到水印也不能排除 AI 参与:模型可能在水印功能上线前输出、文本经重度编辑或翻译、段落过短无法可靠检测,或元数据在格式转换与截图中被剥离。水印能否在编辑、重排版和翻译后存活,将是检验其价值的关键。

AI 文本检测在教育等敏感领域影响尤深。研究显示过度依赖 AI 工具会削弱批判性思维与写作能力,已有诈骗者利用 AI 注册虚假学生身份骗取助学金。但不可靠的检测器同样危险,可能导致误判学生作弊的错误指控。Anthropic 的水印方案若比现有第三方工具更可靠,或将为这一困局提供新出路。

行业格局:Google 开源、OpenAI 搁置

Anthropic 并非孤例。Google DeepMind 已开源 SynthID 水印系统并内置于 Gemini,通过在词元预测时微调概率值实现不降质水印,支持多语言但编辑后检测仍困难。相比之下,OpenAI 拥有准确率达 99.9% 的文本检测器却搁置两年未发布,原因包括用户可通过翻译或改写绕过、可能污名化特定群体,以及公开检测器或损害自身商业利益。

Anthropic 的决定亦存商业风险。Claude 在知识工作领域尤受学生欢迎,更可靠的检测能力可能降低这部分用户吸引力。但随着 AI 生成内容泛滥与深度伪造风险加剧,内容溯源已从可选项变为必选项,率先建立可信标识体系的厂商将在监管趋严环境中获得先发优势。