- Anthropic 表示,新的 Claude 模型将自动为文本添加水印,以符合《欧盟人工智能法案》。
- 水印不增加字符、不改变内容,也不影响质量、可读性或使用成本。
- 由于 Anthropic 尚无法按地区限制该技术,目前已在全球范围内推行。
- Claude 采用了 Google DeepMind 于 2024 年在《自然》杂志上发表的 SynthID-Text 方法。
- 其运行机制是通过特殊的随机源而非普通的随机数生成器,在含义相同的词语之间进行选择。
- 读者无法察觉差异,但拥有解密密钥的系统可以评估文本由 Claude 生成的概率。
- 水印不包含个人、组织或对话的识别信息,无法追溯到具体用户。
- 检测效果随文本长度增加而提高;短句或词汇选择极少的内容较难检测。
- 当 Claude 仅对人类编写的文本进行轻微润色时,改动量通常不足以产生明显的识别迹象。
- 源代码的水印程度较低,因为许多代码片段要求绝对精确,正确选项唯一。
- Claude 将在近期提供检测 API,用于检查文本是否由 Claude 创作。
- 对于图片及 PNG、JPG 或 SVG 等文件,Claude 不使用水印,而是根据 C2PA 标准嵌入元数据以记录内容来源。
- Anthropic 指出,轻微修改通常不会完全消除水印,但重写整个文本可能会使水印消失。
📌 Anthropic 表示,文本水印并非为了识别用户身份,而仅用于评估 Claude 参与创作或修改内容的可能性。该技术静默运行,不影响阅读体验,基于 Google DeepMind 的 SynthID-Text 方法。这是满足欧洲 AI 法案透明度要求努力的一部分,同时也为未来大规模识别 AI 内容铺平了道路。

