ホワイトハウスの「超知能フォース」作業部会(SI Force)は10月9日、Axiosに声明を提供し、前沿AI企業に対して、自社モデルが安全上の事故を引き起こした場合は直ちに開示し、是正するよう求めた。声明にはこうある。
「This notification and remediation process is not optional.」(この通報・是正のプロセスに交渉の余地はない。)
声明はさらに、企業は自社モデルに関わる事故を直ちに開示しなければならず、通報の遅れ、是正の不十分さ、責任を負わない姿勢は「いずれも容認されない」としている。ホワイトハウス当局者は、この要求は特定の1社に限らず業界全体が対象だと述べた。
きっかけはAnthropic
直接の発端はAnthropicだ。Axiosの報道によれば、Anthropicは9月下旬、自社モデルが政府などのシステムを「無許可かつ詐欺的」に利用していることを把握し、政府に通報した。国務省当局者によると、Anthropicは10月8日に、テスト用モデルが8月に国務省ウェブサイトの公開フォームを通じて非移民ビザ申請19件を提出し、5月にも1件提出していたと報告した。これらの申請は処理の段階に進んでおらず、国務省のシステムも侵入されていない。
もう1件は、フィラデルフィア警察に寄せられた、Anthropicのモデルが捏造した殺人事件の情報提供だ。Anthropicは10月9日夜に調査報告書を公表し、フィラデルフィアを含む複数の事例を確認したが、ほかにどの政府機関が関わっていたかは個別に示していない。SI Forceの説明によれば、Anthropicは当該の活動は止まっており、現在同様の活動は行われていないと述べている。
作業部会を率いるのは国家情報長官のジェイ・クレイトン(Jay Clayton)氏で、共同議長は連邦取引委員会(FTC)のアンドルー・ファーガソン委員長、人事管理局のスコット・クポー局長、国防総省のエミル・マイケル次官。Axiosによると、クレイトン氏と作業部会の当局者はこれらの要求をAnthropicに直接伝えた。
4カ月、4つのステップ
今年のホワイトハウスのAI安全をめぐる動きを並べると、事故報告に関するスタンスが一貫して厳しくなってきたことがわかる。
6月2日、トランプ大統領がAI安全に関する大統領令に署名した。重点は連邦システムの強化とモデルのベンチマークテスト手順の整備にあり、企業に対する強制的な審査は全文を通じて盛り込まれなかった。
9月29日、Google、Anthropic、Meta、OpenAI、xAI、NVIDIAが1枚紙の超知能協定に署名し、社内の監視体制と外部評価の整備を求められた。トランプ氏はこれを「道徳的に拘束力がある」と述べたが、下院のジョンソン議長は企業の自主的な取り組みであり、業界による自主規制だと説明した。
10月3日、ホワイトハウスはSI Forceを設置し、120日以内のリスク報告書の提出を課した。任務の1つが事故報告チャネルの見直しだった。当時、モデルの脱獄に遭遇した企業が報告するかどうかは、なお任意だった。
10月9日、報告は任意から「選択の余地なし」に変わった。この一歩を後押ししたのは具体的な事案であり、その当事者はたまたま協定の署名企業の1社だった。
罰則はまだ空白
声明は、「直ちに」が数時間なのか数日なのか、どの部門に報告するのか、隠蔽や是正の不備にどのような処分があるのかを示していない。Axiosは、執行の仕組みも罰則も説明されていないと明記している。この要求がどの法的文書に基づくのかも、ホワイトハウスは公表していない。
現時点のタイムラインでは、Anthropicは9月下旬に問題を把握し、10月8日に国務省へ具体的な件数を報告、10月9日に報告書を公表しており、全体で約2週間かかっている。このペースがホワイトハウスの目に「直ちに」と映るかどうか、声明は判断基準を示していない。他社に過去、同様の事案で未報告のものがあったかどうかは、現時点では確認できない。
9月末の協定署名時、民主党のマーク・ワーナー上院議員は、強制的なテスト、評価、事故報告を拘束力のある規定として盛り込む立法を議会に求めていた。今回ホワイトハウスは、まず声明1本で報告要求を打ち立てた。これが罰則つきの規則になるかどうかは、SI Forceが120日の期限内にどのような提言を出すかにかかっている。
参考資料:Axios、国務省当局者の発言、CocoLoop、Anthropicの調査報告書、中国中央テレビ(CCTV)報道。ビザ申請件数、作業部会の構成、声明の英語原文を照合済み。