How Claude's text watermarking works

Anthropic
AnthropicはEU人工知能法への準拠のため、出力品質に影響を与えないテキストウォータマーク機能をClaudeに導入します。

概要

Anthropicは、EU人工知能法(EU AI Act)への準拠を目的として、将来のClaudeモデルにテキストウォータマーク機能を導入します。Google DeepMindのSynthID-Textに基づくこの手法は、生成された単語に人間には検知できない統計的パターンを埋め込むものであり、出力の品質や創造性に悪影響を与えず、追加のトークンやコストも発生させません。個人情報を一切含まないためプライバシーも保護されますが、事実に基づく記述やコードなど、選択肢が限られる場合にはウォータマークが反映されにくくなります。

(出典:Anthropic)