Anthropic 为 Claude 引入"隐形水印"引争议,开发者火速推出去水印工具
人工智能企业 Anthropic 近期在其部分 Claude 模型中引入了一种"不可感知的水印"技术。据该公司介绍,这种水印通过 Claude 独特的选词方式形成统计模式,即使用户直接复制粘贴,水印也会随内容保留。Anthropic 表示,此举旨在履行欧盟《人工智能法案》的相关合规承诺。
然而,这一做法在科技行业引发广泛争议。许多用户担忧,即便仅将 Claude 用于基础的文本校对、翻译或总结,这种隐形标记也会附着于最终成果。部分用户已向媒体反映,因不满该机制而取消了订阅服务。与此同时,"去水印"相关搜索热度攀升,各类消除 AI 标记的工具开始涌现。
面对用户反弹,多位开发者迅速推出应对方案。巴黎科技创业者、AI 电商工具 Memo 创始人 Guillaume Meyer 在 Anthropic 宣布计划数日后发布了开源项目 Watermarks Remover。该工具通过删除隐藏字符和元数据,并在保持原意的前提下改写文本,以破坏可能携带水印的统计性选词模式。项目开发仅耗时约 5 小时,在 GitHub 上迅速获得超过 1.4 万个 Star,但 Meyer 坦言该工具无法保证 100% 彻底移除水印。
Meyer 公开表示,自己支持内容归属标注,但反对这种将作者身份简单二元化的非理性水印技术。此外,AI 教育服务提供者 Sabrina Ramonov 开发了一款免费的浏览器端工具,宣称可从文本、PDF、Word 文档、网页、图片及数据文件中清除隐藏 AI 标记。常驻东京的软件开发者 Ansh Aneja 也在 Anthropic 宣布当天推出了专门针对 Claude 的水印移除工具,随后发布本地开源版本 MarkScrub,据称用户量在一天内大幅增长。
从技术角度看,苏黎世联邦理工学院研究员 Thibaud Gloaguen 指出,这些工具再次体现了水印技术长期存在的局限性——通过重新措辞等方式,总会有办法移除水印。
法律层面,这些工具目前处于微妙的灰色地带。欧盟《人工智能法案》要求 AI 服务提供商的内容标记系统能够抵御常见修改和对抗性操作,并将移除或修改列为应评估的潜在威胁,但法案本身并未明确禁止第三方开发或尝试移除 AI 水印。法律专家指出,若用户利用此类工具将 AI 生成内容恶意伪装为人类创作,可能违反 Anthropic 的使用政策,因其条款禁止用户冒充人类。
据悉,Anthropic 计划在下一代模型发布时同步推出文本检测 API,并逐步将水印功能推广至旧款模型。围绕 AI 水印与去水印工具的博弈,预计仍将持续升级。