Anthropic 已开始在新一代 Claude 模型生成的文本中嵌入机器可读水印。这项做法先用于 2026 年 8 月 2 日后在欧盟推出的相关模型,随后将扩展到全球,覆盖 Claude、API、Claude Code,以及多家云端合作渠道。
与欧盟规范同步实施
Anthropic 在支持文档中披露了这一安排。背景是公司已签署欧盟《AI 法案》配套的透明度行为准则。公司称,水印直接嵌入文本本身,用户肉眼无法识别,也不会改变文本含义、可读性或表面质量。
按照其说法,这类标记在复制、粘贴后仍会随文本保留,经过部分编辑后也可能继续存在。除文本层面的水印外,文件还会附带第二层标记,即基于 C2PA 开放标准的签名元数据,用于记录内容来源及后续是否被修改。
检测方式尚未公开
Anthropic 目前没有说明水印的具体实现方式。现有信息仅显示,水印在模型层面生效,属于文本原生标记,而不是单独附加的外部元数据工具。用于验证水印的检测文档和识别工具,至今也未公布。
外界据此推测,这可能是一种统计特征方案,即模型在措辞选择上加入微弱但可检测的偏向。这类思路与 Google 的 SynthID Text 接近,但在 Anthropic 发布检测器前,外界仍无法确认其具体机制和阈值。
开源项目已尝试移除
在 Anthropic 公布安排后不久,GitHub 上已出现多个针对 Claude 水印的移除项目。其中一个项目会先清理不可见 Un代币发行de 字符,再用非 Claude 模型重写文本,以打乱可能存在的词元分布特征。
另一个更大的开源项目则声称,可移除 Claude 文本标记,以及 PNG、JPEG、SVG、PDF、DOCX 等文件中的 C2PA 和 SynthID 类信号。相关开发者认为,统计型文本水印并不足以可靠证明内容来源,反而可能促使用户再调用第二个模型清洗文本。
报道还提到,Anthropic 今年 3 月曾移除 Claude Code 中一项隐藏追踪标记。研究人员当时称,这类未披露的 Un代币发行de 标记涉及部分用户位置和代理使用信息,这也让此次水印计划引发更强的隐私讨论。
补充信息:报道提到,美国一项名为 COPIED Act 的法案也在推动 AI 内容水印标准化。Anthropic 目前仍未说明何时发布可供外部验证的检测工具。
1
收藏















