自ら脆弱性を見つけるAI
まず数字から見ていこう。AnthropicがMythos Previewをテストしたところ、一度の試行で脆弱性を再現・悪用できたケースは83.1%だった。比較対象として、同社のClaude Opus 4.6は同じ指標でほぼ0%だった。
わずかな進歩ではない。0%から83%への飛躍だ。
具体的に何ができるのか。Mythosは4つの独立した脆弱性を連鎖させるブラウザエクスプロイトを作成し、複雑なJITスプレー技術を用いてレンダラープロセスとOSのサンドボックスの両方を脱出した。また、ROPチェーン技術を使い、FreeBSD NFSサーバーの脆弱性を悪用するリモートコード実行プログラムも作成した。
Anthropic自身の発表によれば、このモデルは主要なすべてのOSとブラウザで数千件の新しいゼロデイ脆弱性を発見したという。
Mythosが27年もの歴史を持つ古い脆弱性を発見したという以前の報道は、氷山の一角に過ぎなかったようだ。
FRB議長、財務長官、6大銀行CEOが一堂に
Anthropicは4月7日にMythosプレビューを公開した際、「Project Glasswing」計画のもと、アクセス権を約40の組織に限定した。参加組織には、Amazon、Apple、Microsoft、Google、Cisco、CrowdStrike、JPモルガン・チェース、NVIDIA、Broadcom、Palo Alto Networks、Linux Foundationが含まれる。各参加組織には最大1億ドルの計算リソースも提供された。
そして4月10日、連邦準備制度理事会(FRB)のジェローム・パウエル議長とスコット・ベセント財務長官は、ゴールドマン・サックス、ウェルズ・ファーゴ、モルガン・スタンレー、バンク・オブ・アメリカ、シティグループのCEOを一室に招集し、緊急会合を開いた。
議題は、AnthropicのAIが悪意ある者に渡った場合のリスクだ。
CrowdStrikeのCTOは率直に述べた。「脆弱性の発見から悪用までの時間枠は、数ヶ月から数分に短縮された。AIがこの速度を根本的に変えたのだ。」
しかし国防総省は依然としてAnthropicを禁止
ここに最大の矛盾がある。
パウエル氏とベセント氏がワシントンで銀行家を招集しMythosを評価している一方で、国防総省は依然としてAnthropicをサプライチェーン・ブラックリストに掲載し、国防部門に対しAnthropicの全プラットフォームの使用停止を命じている。
トランプ大統領とピート・ヘグセス国防長官の理由は、Anthropicが軍事シナリオでのAI使用を制限していることにある。
結論として、ホワイトハウスは一方でウォール街に防御策をテストさせながら、他方で軍による同社の使用を禁止している。同一企業、同一モデル、同一政権でありながら、まったく相反する姿勢だ。
元ホワイトハウスAI顧問のデビッド・サックス氏は、Anthropicがセキュリティ不安を利用して自社製品を販売し、規制政策に影響を与えているのではないかと疑問を呈した。この批判には一定の正当性がある。
Anthropicの説明
Anthropicの論理はこうだ。モデルが危険だからこそ、簡単に公開できない。Project Glasswingの設計思想は、トップテクノロジー企業がMythosを使って自社システムの脆弱性を発見し、攻撃者より先に修正することにある。
- Mythosが脆弱性を発見 → 参加組織が修正 → 防御側が優位に立つ
- 参加者間でセキュリティ情報を共有
- Anthropicは発見した全脆弱性を関連ベンダーに報告
これは「AIによるAI対策」と呼ばれる。問題は、Anthropicがアクセス境界を制御できると誰もが信じているわけではないことだ。参加40組織には競合他社も含まれており、脆弱性情報の共有自体が複雑な駆け引きとなる。
そして「数千件」という数字は、まだ詳細に分解されていない。
これが意味すること
Mythosの事例は、どのベンチマークスコアよりも重要だ。なぜなら、AIがあらゆるシステムの脆弱性を自動的に発見できるなら、サイバーセキュリティの根本的な論理を書き換える必要があるという、現実の神経を突いたからだ。
パウエル氏とベセント氏が銀行CEOを緊急会合に招集したのは、AIに可能性があるかどうかを議論するためではない。脅威は現実的かつ差し迫ったものだと彼らが認識したからだ。
そして、この緊急会合自体が、このAIの能力を最も強力に証明している。
サックス氏の批判が妥当かどうかは別として、AIモデルがFRB議長とウォール街のトップ銀行CEOを一堂に集め、セキュリティブリーフィングを開かせた——これは人類史上初めてのことだ。
出典:Trump officials may be encouraging banks to test Anthropic's Mythos model(TechCrunch);Anthropic Mythos model can find and exploit 0-days(The Register);Powell, Bessent Warn Banks About Security Risks From Anthropic's Mythos AI(Bloomberg/Yahoo Finance);CocoLoop、After Anthropic's Mythos AI uncovers thousands of zero-day bugs, top US officials huddle with bank CEOs(TechXplore);Anthropic withholds Mythos Preview model because its hacking is too powerful(Axios)。