LLM推論3本の記事が同じ件を報じた初出 8/22 23:02
Claudeのテキスト透かし(ウォーターマーク)は何をしているのか ── サンプリングの仕組みから理解する
https://zenn.dev/topics/ai/feed2026/8/22
AI要約
この記事は、AnthropicがClaudeの出力テキストに導入すると発表した「透かし(ウォーターマーク)」の仕組みについて、サンプリングの観点から解説しています。Sebastian Raschka氏の解説動画とスライドを基に、その技術的な詳細を掘り下げています。
AI要点
- Claudeのテキスト透かしは、LLMの重みに変更を加えず、次トークン選択時のサンプリング段階にのみ介入する。
- 透かしの仕組みは、秘密鍵と直前数トークンから乱数シードを決定し、これにより「ランダムだが再現可能」なトークン選択を行う。
- ユーザー視点では、乱数シードが固定されるのとほぼ同等であり、透かしによる文章の質低下は仕組み上起こりにくい。
- 透かしの検出にはAnthropicが持つ秘密鍵が必要であり、第三者が透かしの有無を判別することはできない。
- 検出効率化のために「トーナメントサンプリング」が採用されているが、透かしは単語の書き換えで除去可能である。
なぜ重要か
LLMの出力に透かしを埋め込む技術は、AI生成コンテンツの追跡可能性を高め、偽情報の拡散防止や著作権保護に貢献する可能性がある。品質低下の懸念が少ない点は、実用化に向けた重要な利点となる。