- Anthropicは、欧州連合(EU)のAI法を遵守するため、新しいClaudeモデルが文書に自動的にウォーターマーク(電子透かし)を付与すると発表した。
- 透かしは文字を追加せず、内容を変更せず、品質、可読性、または利用コストに影響を与えない。
- Anthropicは現在、地域ごとに制限をかけることができないため、この技術は世界中で展開されている。
- Claudeは、2024年にGoogle DeepMindが科学誌『Nature』で発表した「SynthID-Text」手法を採用している。
- 仕組みは、通常の乱数生成器の代わりに特殊なランダムソースを通じて、同等の意味を持つ単語の選択を調整することで機能する。
- 読者が違いに気づくことはないが、復号キーを持つシステムは、その文書がClaudeによって生成された確率を推定できる。
- 透かしには個人、組織、または会話を特定する情報は含まれておらず、ユーザーを追跡することはできない。
- 検出精度はテキストの長さに比例して向上する。短い文章や語彙の選択肢が極めて少ないコンテンツは検出が困難になる。
- Claudeが人間が書いた文章を軽く校正しただけの場合、変更箇所が少なすぎて明確な識別サインを残せないことが多い。
- ソースコードは、多くの箇所で絶対的な正確性が求められ、正解が一つしかないため、透かしの付与レベルが低くなっている。
- Claudeは、文書がClaudeによって作成されたかどうかを確認するための検出APIを近日中に提供する予定である。
- 画像やPNG、JPG、SVGなどのファイルについては、透かしではなくC2PA標準に準拠したメタデータを付与してコンテンツの出所を記録する。
- Anthropicは、軽微な編集では通常透かしは完全に消えないが、文章全体を書き直すとこのサインが失われる可能性があると指摘している。
📌 Anthropicによれば、テキストの透かしはユーザーの特定を目的としたものではなく、Claudeが内容の作成や編集に関与した可能性を評価するためのものである。この技術は静かに動作し、読書体験を損なうことなく、Google DeepMindのSynthID-Text手法に基づいている。これは欧州AI法の透明性要件を満たす取り組みの一環であり、将来的な大規模なAIコンテンツ識別への道を開くものである。
