AI生成テキストに「見えない透かし」を入れる——しかも単語は一切歪めずに。その巧妙な仕組みが公開されました。
タイトル: How Claude's text watermark works
URL:
ClaudeがEU AI法に対応し、将来モデルに目に見えないテキスト透かしを組み込みます。注目すべき3点を掘り下げます。
🎲 注目ポイント1: 変えるのは「単語」ではなく「ランダム性の源」
透かしというと単語を差し替える印象がありますが、この手法は違います。生成時のランダム性の源を、エンコーディングキーと直前の単語から決める方式に差し替えるだけ。モノポリーでサイコロの代わりに円周率πの桁を順に使うようなもので、出力は読者に知覚できず、後から検証だけが可能になります。採用技術はGoogle DeepMindがNatureで発表したSynthID-Textです。
⚡ 注目ポイント2: 品質・速度・コストへの影響はほぼゼロ
社内テストとDeepMindの統制実験で、透かし有り/無しのテキストに統計的に有意な差はなし。速度への影響は無視でき、追加トークンも不要で料金も据え置き。透かしにはユーザーや組織、特定チャットに遡れる識別情報は含まれず、プライバシーも保たれます。
🔍 注目ポイント3: 万能ではない、その正直な限界
長い文章ほど検出は正確になりますが、短いサンプルは苦手。事実性が要求される箇所や、数式・機能するコードのように言い換えの余地がない出力には透かしを付けられません。軽微な編集は残っても、全面書き換えでは消えます。検出APIは近日提供予定です。
規制対応と実運用品質を両立させる、現実的な透明性の実装だと言えます。
#
AI透かし# #
EUAIAct#