Anthropicは、AIモデル「Claude」が生成するテキストに電子透かし(ウォーターマーク)を導入すると発表した。EU AI法への対応として始まるが、地域を限定する手段がまだないため、日本を含む全世界のユーザーに適用される。出力の品質・速度・料金には影響しないとされている。

- 透かしはテキストの単語選択に統計的パターンを埋め込む方式で、読者には判別できない
- コードや事実記述など「正解が1つ」の箇所には適用されず、料金・速度の変化もない
- 検出APIはEU法で求められる機関(規制当局・メディア・研究機関など)向けに限定公開中
透かしの仕組みと適用範囲
採用されたのはGoogle DeepMindが2024年にNature誌で発表した「SynthID-Text」をベースにした方式だ。大規模言語モデルは次の単語を確率的に選ぶが、どちらを選んでも意味がほぼ変わらない場面で、乱数の代わりに鍵に基づく数値を使って選択する。これにより、テキスト全体に統計的なパターンが生まれる。
一方で、コードのように正確さが求められる部分や、「2+2=4」のように正解が決まっている事実記述では透かしが適用されない。校正・軽い編集でも人間が書いた単語がほとんど残るため、透かしが検出できるほど蓄積されないケースがある。翻訳ではClaude自身がすべての単語を選ぶため、透かしが適用される。
ユーザーへの影響と制限
Anthropicは、透かしが出力の質・創造性・可読性に影響しないと説明している。Google DeepMindがGeminiで行ったA/Bテストでも、評価に統計的有意差は出なかったという。追加トークンも発生せず、利用料金は変わらない。
透かしには個人・組織・チャットを特定できる情報は含まれない。ただし透かしの限界として、短い文章では検出精度が下がること、テキストを全面的に書き換えれば透かしは消えることが挙げられている。
検出APIと画像への対応
テキスト透かしの検出APIは現在プライベートプレビューとして、EU法で指定される対象組織(規制当局、メディア、ファクトチェッカー、研究機関、教育機関など)に限定公開されている。今後アクセス範囲を拡大する予定とのこと。
また画像などのファイルについては、業界標準「C2PA」に準拠したコンテンツクレデンシャルをメタデータに付与する方式を採用する。ファイル自体は変更されず、Claudeが関与したことだけが記録される。
日本のユーザーへの影響
今回の透かし導入はEU AI法への対応が発端だが、Anthropicは地域ごとに適用を分ける仕組みがまだないため全世界で一律に適用するとしている。日本でClaudeを利用しているユーザーも対象となるが、出力品質や料金に変化はなく、日常的な利用で意識する場面はほぼないと考えられる。


コメント