AnthropicがClaudeのテキスト透かしの仕組みを解説、統計的パターンを使用し隠し文字はないが削除は困難
Anthropicは、Claudeが生成するテキストの透かしの仕組みについて、SynthID-Text基準を通じた統計的技術を使用しており、特殊文字の埋め込みはないが、コピー&ペースト後もテキストに残ると説明しました。
Anthropicが欧州連合(EU)のEU AI法を遵守するため、AIが生成したテキストやファイルに透かし(ウォーターマーク)を埋め込む方針を発表した後、この措置がヨーロッパだけでなく世界中のユーザーに影響を与えるため、直ちに批判の波が巻き起こりました。同時に、多くの人々から、このような透かしは簡単に削除できるのではないかという疑問の声が上がっていました。
最近、Anthropicはヘルプセンターを通じて詳細を説明し、モデルがテキストを生成する際の単語(トークン)の選択確率を調整する「統計的ウォーターマーク(Statistical Watermarking)」技術を使用していることを明らかにしました。これにより、通常のテキストと変わらず自然に読める状態を保ちながら、検出可能な統計的パターンが生まれます。また、特殊文字や隠しUnicode文字が挿入されることは一切ないと明確に否定しています。
使用されている基準はGoogle DeepMindが開発した「SynthID-Text」です。この仕組みにより、ユーザーが別の場所へテキストをコピー&ペーストしても、透かしが「テキストに付随して残る」ようになっています。ただし、テキストが大幅に修正またはパラフレーズ(言い換え)された場合、検出能力は低下するか失われる可能性があります。
この背景にある理由は、AI生成コンテンツの透明性を規定するEU AI法第50条への準拠です。Anthropicは2026年8月2日以降にリリースされるモデルにこれを適用し、世界規模で強制実施します。この情報はEngadgetやForbesなどの海外メディアによっても一斉に報じられ、Anthropicがメタデータや隠し文字の埋め込みではなく統計的手法を選択したことが確認されています。
タイのClaudeユーザーもこの措置が世界中で適用されるため直接的な影響を受けます。タイがEUの管轄外であっても、AIから得て再利用されたテキストは、AIによるものかどうかの逆検証を受ける可能性があり、これは透明性、学術論文、商用コンテンツの利用に関わってきます。