Claudeはテキストにウォーターマークをどう埋め込むのか
画像は人間が知覚できない余白に信号を隠せますが、テキストにはその余白がありません。モデルが単語を選ぶ方法を変えて印を埋め込む仕組みと、短い文章やリライトで崩れてしまう限界を整理しました。
AI・テックAnthropicが8月10日に明かしたテキストの印
8月10日、Anthropicがヘルプセンターにひとつの文書を静かに公開しました。2026年8月2日以降にリリースされるClaudeモデルは、生成したテキストに機械が読み取れる印を埋め込むという内容でした。目には見えず、コピー&ペーストしても残り、ある程度の編集にも耐えるといいます。
画像であればすぐに理解できたはずです。Google DeepMindのSynthIDが、生成画像に見えないウォーターマークを入れることはよく知られていますから。しかし、文章の中に目に見えないものをどうやって隠すのでしょうか。文字の間に特殊文字でも挟み込むのでしょうか。
テキストは、画像のピクセルのように微小に変更しても目立たない部分を見つけるのが困難です。そのためこの技術は、文章に印を付加するのではなく、モデルが単語を選ぶ仕組みそのものをほんの少しずらします。印が文章に別途乗せられるデータではなく、どの単語が選ばれたかの中に込められるわけです。
画像には隠す場所があり、テキストにはありません
まず、画像のウォーターマークがなぜ直感的に理解できるのかから整理してみましょう。
デジタル画像は、数百万個のピクセルによる数値の配列です。そして人間の目は、こうした数値の微細な違いを感知できません。あるピクセルの赤色の値が137であろうと138であろうと、私たちには見分けがつかないのです。音声も同様です。人間の耳には聞き取りにくい周波数帯が存在し、大きな音にかき消される小さな音もあります。
人間の感覚がこうした微細な違いを識別できないおかげで、情報を乗せて運べる余白が生まれます。SynthIDをはじめとする画像ウォーターマークは、この余白に信号を埋め込みます。オリジナルとウォーターマークが入ったバージョンを並べて見ても人間には違いがわかりませんが、専用の検出器はその微細なパターンを読み取ることができます。すでに作成された画像に対して、後から上乗せすることも可能です。
テキストには、この余白がありません。
文章はピクセルの配列ではなく、トークン1の並びです。そして、すべてのトークンが意味を持ちます。「今日は天気がいいです」から一文字を少し変えるだけでも、誤字になったり意味が変わってしまったりします。137を138に変えるような、無害な微調整が原理的に不可能なのです。目に見えないUnicode文字を挿入する方法もありますが、これはウォーターマークというより単なる隠し文字にすぎません。コピーして別のエディタに貼り付ければ大半が消えてしまいますし、見つけ出して削除するのも極めて簡単です。
そのため、テキストのウォーターマーク技術はまったく異なるアプローチを取る必要がありました。書き終えた文章に信号を埋め込むのではなく、文章を書くプロセスそのものに介入する方式です。