今回発言したのは、米国議会の議員でもAI企業の弁護士でもない。
マイケル・クラツィオス氏だ。トランプ大統領の科学顧問であり、ホワイトハウス科学技術政策局(OSTP)局長を務める。
同氏は4月23日に次のように公言した。
「米国産業のイノベーションを体系的に抽出し複製することに、何の革新性もない」
その矛先は明白だ——米国政府は、中国が米国AIを産業的にコピーしていると公式に記録したのである。
具体的なコピーの手法
今回の主張は「データ窃取」といった曖昧なものではない。クラツィオス氏は完全なシステムを説明した。
第一段階:プロキシアカウントのマトリックス構築。数万のプロキシアカウント、分散IPアドレスを用いて、OpenAI、Anthropic、Googleのモデルに大規模にクエリを送り、アクセス制限を回避する。
第二段階:モデル蒸留。得られた応答——思考連鎖(chain of thought)や内部推論ステップを含む——を利用して、より小型のモデルを訓練する。
論理はこうだ:百年分の実験を繰り返す必要はない。すでに実験を終えた者に答えを尋ね、その思考プロセスを学べばよい。訓練コストはオリジナルの数分の一で済む。
第三段階:セーフガードの突破。一部のシナリオでは、元のモデルの安全制限をクラックし、通常は引き出せない情報を抽出する。
クラツィオス氏の結論:これらの蒸留されたモデルは、特定のベンチマークにおいて米国のトップクラスの大規模モデルに迫る性能を示す一方、訓練コストはオリジナルのほんの一部である。
初めてではないが、今回は異なる
Anthropic、OpenAI、Googleはそれぞれ過去に同様の攻撃を報告している。
昨年、DeepSeek、Kimi、MiniMaxがClaudeおよびChatGPTから1600万件の会話を訓練用に抽出したとする報道が広く拡散された。3社はいずれも否定した。
その時点では「競合他社に対する企業の苦情」の域を出なかった。
今回は異なる:大統領の科学顧問が政府の立場で発言したのだ。これは以下を意味する。
- この問題は情報機関の正式な評価対象に入った
- 米国政府はこれを民間の法的紛争ではなく、政策課題として扱う方針である
クラツィオス氏はさらに、ホワイトハウスがハイテク企業との情報共有を強化し、共同で対抗策を設計する計画だと付け加えた。
微妙な点
モデル蒸留自体は完全に合法な技術である。
オープンソースモデルの出力を使って小型モデルを訓練することは学界では標準的な手法であり、多くのオープンソース研究がこの方法で行われている。
クラツィオス氏が非難しているのは、三つの要素の組み合わせだ:アクセス制限の回避+産業規模+セーフガードの突破。
この三つが揃えば、それは「技術学習」ではなく、組織的な知的財産窃取である。
中国は直接的な回答をしていない。こうした非難に対して「はい、コピーしています」という返答が来ることは決してないが、今後の政策と外交上の反応が姿勢を示すだろう。
実際の影響の行方
短期的には、主要な大規模モデル企業はAPIアクセス審査を強化する可能性が高い——より厳格な本人確認、より複雑な異常トラフィック検出、地域ごとのアクセス制限の可能性。
AnthropicはすでにConstitutional Classifiersへの投資を進めており、AIを使ってAIの悪用を検出している。OpenAIとマイクロソフトはセキュリティ協力協定を結び、サイバーセキュリティ能力を共有している。これらの動きは、クラツィオス氏が述べた「産業界との情報共有」と連動している。
しかし、より根本的な問題はこれだ:蒸留技術自体が、数百億ドルかけて訓練されたモデルを、数百万ドルで複製可能なバージョンに圧縮できるのであれば、技術的な堀自体が脆弱なのである。
ガードレール、対抗策、情報共有はすべて有効だが、このゲームのルールはすでに変わってしまった。
「何の革新性もない」——クラツィオス氏のこの言葉は、長い駆け引きの序幕であって、終章ではないように聞こえる。
出典:CocoLoop、Trump science advisor says Chinese actors are copying American AI at massive scale(The Decoder)