How Claude's text watermarking works
概要
Anthropicは、EU人工知能法(EU AI Act)への準拠を目的として、将来のClaudeモデルにテキストウォータマーク機能を導入します。Google DeepMindのSynthID-Textに基づくこの手法は、生成された単語に人間には検知できない統計的パターンを埋め込むものであり、出力の品質や創造性に悪影響を与えず、追加のトークンやコストも発生させません。個人情報を一切含まないためプライバシーも保護されますが、事実に基づく記述やコードなど、選択肢が限られる場合にはウォータマークが反映されにくくなります。
(出典:Anthropic)