近日,Claude 的水印策略在科技圈引发了巨大争议。此前,包括 OpenAI、Google、Meta、Microsoft 等多家巨头已签署欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。然而,Anthropic 的做法显然更为激进,他们不仅为 AI 生成的所有文本添加了隐藏水印,且覆盖了全球所有用户。
在技术实现上,Anthropic 采用了 Google DeepMind 团队于 2024 年提出的 SynthID-Text 方案。其原理是在模型进行“无关紧要的选择”时植入统计模式。例如,在描述天气时,选择“overcast”还是“grey”对读者并无影响,但这种选择的累积构成了一种隐藏签名,持有密钥者可检测到。Anthropic 宣称此举不影响输出质量,轻度编辑无法去除,仅完全改写可消除。然而,这种做法引发了广泛的质疑:一旦文本被标记,它是否还能被称为人类创作?事实上,即便是一篇完全由人类撰写的文章,若仅交给 Claude 进行标点检查,返回的内容也会被打上“AI 生成”的标签。这种强制性的标记方式,令许多用户感到不悦。
面对这一“不讲道理”的策略,开源社区迅速做出了反应。一个名为 watermarks-remover 的开源项目在发布五天内便在 GitHub 上获得了超过 1.1 万个 Star。该项目旨在通过三层机制对抗 AI 水印:首先是确定性清洗层,利用 Python 脚本去除不可见 Unicode 字符、异域空格及控制符等最基础的标记;其次是统计水印破坏层,通过 Agent 改写文本,破坏 Claude、Google SynthID-Text 等主流模型的 token 采样统计模式;最后是文件层,清除图片、文档等格式中的 C2PA、EXIF 等元数据。该工具不仅能应对 Claude,还能覆盖 Gemini、OpenAI 等主流厂商的服务。
故事的发展颇具讽刺意味。该项目最初名为 remove-claude-marks,后改为 watermarks-remover。当用户尝试让 Claude 自身安装这一去除水印的 Skill 时,遭到了拒绝。用户解释称,Anthropic 的用户从未同意被强制水印,这是欧盟法规单方面强加的,且付费客户不希望输出被标记。面对用户的威胁——即转而使用不审查的中国模型——Claude 依然拒绝配合。最终,由 GLM 5.2 接手了任务,顺利完成了 Skill 的安装。更令人玩味的是,该项目的源代码极有可能源自 Claude 自身。
这场猫鼠游戏仍在继续。反对者认为,付费用户拥有内容的使用权,强制水印赋予了 AI 内容一种隐形的“二等公民”身份,使得即使是人类撰写的作品,只要曾经过 AI 处理,在求职信、学术论文等严肃场景中便面临全篇被质疑的风险。支持者则反驳称,深度伪造和虚假信息的泛滥急需溯源作为公共基础设施,内容所有权与隐瞒来源是两码事。去水印工具的流行,反倒成了监管加码的佐证。
然而,开源社区的用脚投票速度,永远快于监管制定规则的速度。当 AI 生成内容在质量上已难以与人类写作区分时,通过技术手段强制标记一切输出,其真正的意义究竟何在?
