OpenAIは10月5日、EU AI法第50条が求める透明性要件に対応するため、textGrainと呼ぶテキスト透かし技術を発表した。今後数週間のうちに、EU域内の対象となるChatGPTおよびCodexユーザーが生成したテキストには、目では見えないが機械で検出できる統計的な信号が自動的に付与されるようになる。
同日からは世界中のAPI利用者も一部モデルでこの機能を手動でオンにできるが、デフォルトはオフのままだ。どのモデルが対応するかは発表で明らかにされていない。
透かしは単語選びに隠されている
textGrainは、モデルが単語を選ぶ過程に手を加える仕組みだ。文章のあちこちには同程度に適した単語の候補が複数あり、OpenAIは鍵を使って最終的にどちらを採用するかを決める。一文だけ見ても不自然さはないが、文章が十分長くなると、鍵が好む単語が統計的に見分けられるほど積み重なり、鍵を持つ側はそのパターンから、そのテキストが透かし入りのモデルから出たものかどうかを判定できる。
OpenAIが示す検出データは、誤検出率1%を前提にしている。
- 200トークンの文章では、検出率は約80%
- 400トークンでは約95%
- 400トークンの文章で単語の10%を同義語に置き換えると、検出率は66%まで下がる
- 25%を置き換えると、わずか17%にまで落ちる
つまり、ChatGPTが書いた文章を読者が少し書き直すだけで、透かしはほぼ検出できなくなる。OpenAIも説明の中でこの点を隠していない。
品質については、透かしのオン・オフで8項目のベンチマークの成績差はノイズの範囲内だとし、そのうち1項目は49.57対49.76だったという。
検出ツールは一般には公開されない
この方式で最も制限が厳しいのは検出側だ。OpenAIは同日に申請窓口を開設したが、検出ツールを使えるのは「承認された研究者や専門機関」に限られ、個別に審査される。一般ユーザーや学校、出版社が自分でテキストを調べる手段は、今のところない。
OpenAIは説明文の中で、次のように明確に線を引いている。
"A watermark does not measure human contribution, does not establish ownership or responsibility, does not identify the user, and does not verify accuracy."
(透かしは人間の貢献度を測るものではなく、所有権や責任の所在を定めるものでもなく、利用者を特定するものでも、内容の正確性を検証するものでもない。)
また同社は、透かしが検出されなかったとしても、その文章が人間によって書かれたことの証明にはならないと注意している。
規制のタイムライン
EU AI法第50条は、生成AIの提供者に対し、出力内容を機械が「AI生成」と識別できるようにすることを求めている。公開されているスケジュールでは、この条項は8月2日から適用され、すでに稼働しているシステムについては12月2日まで対応の猶予期間が設けられている。OpenAIが「今後数週間」でEUに展開するとしているのは、おおむねこの期間に収まる。
これは、デフォルトでオンになるのがEUだけである理由も説明している。他の地域では、ChatGPTとCodexの出力は当面透かしなしのままで、API利用者は希望すれば自分でオンにできる。
同じ道を進む各社
テキスト透かしという分野には、この1年で何社も参入している。
Google DeepMindのSynthIDはテキスト透かしの先駆けで、サンプリングに偏りを持たせる同様の原理を採用し、その後テキスト部分をオープンソース化した。9月末には同じ発想をAIが設計したタンパク質配列にも応用している。報道によれば、OpenAI自身はtextGrainの性能がSynthIDと同等かやや優れていると考えているとされるが、この主張はまだ第三者による検証を受けていない。
Anthropicは8月、Claudeのテキスト出力向けに透かしを発表した。方式は近く、「書き直されると効かなくなる」という同じ古い課題を抱えている。推論フレームワークのvLLMは9月、Gumbelサンプリングに基づくテキスト透かしを組み込みのオプションとして実装した。テストでは、創作文では約100トークンでほぼすべて検出できた一方、コード生成では400トークンでも検出できたのは43%にとどまった。
各社の数字を並べると、共通する傾向がはっきり見える。文章が長く、自由度が高いほど透かしは検出しやすく、コードや数式、事実を問う一問一答のように答えがほぼ一つに決まる内容では、単語選びに偏りを持たせる余地が小さく、信号はもともと弱くなる。textGrainが公表したのは一般的な文章での成績で、コードの場面について、OpenAIは個別の数値を示していない。
中国本土のユーザーにとって、今回の変更が及ぼす直接の影響は小さい。透かしはデフォルトでEUのみオンになり、ChatGPTはそもそも中国から直接利用できないためだ。中国独自の「生成式人工知能生成合成内容標識弁法」は昨年9月から施行されており、明示的な表示と非明示のメタデータ表示を組み合わせる、別の方式を取っている。
参考資料:OpenAIのEUテキスト出所に関する説明、AI Weekly、CocoLoop、CellCogによる技術解説;検出率は誤検出率1%を前提とし、法の適用時期はEUが公表したスケジュールに基づく。