GPT-5.4-Cyber、CTFスコアが27%から76%に急上昇

先週、AnthropicはMythosをリリースし、40組織のみに提供され、一部のチームが27年前の古い脆弱性を発見するのに貢献したと発表した。今週、OpenAIは直接反撃に出た。GPT-5.4-Cyberが登場し、数千人のセキュリティ研究者と数百のチームを対象としており、規模の面でMythosのエリートクラブ路線を圧倒する。

両社は同じ時間枠の中で、全く異なる戦略で同じ分野に挑んでいる。

GPT-5.4-Cyberとは

これは全く新しいモデルではなく、GPT-5.4のサイバーセキュリティ専用バリアントである。核心的な違いは、防御的なセキュリティシナリオに対する制限が、対象を絞って緩和されている点にある。

最も重要な新機能は、バイナリリバースエンジニアリングである。

通常のセキュリティ分析では、ソースコードへのアクセスや手動による逆アセンブルが必要となることが多い。GPT-5.4-Cyberは、コンパイル済みのバイナリファイルを直接受け取り、脆弱性の発見や悪意のあるロジックの特定を支援する。現実には、ソースコードが入手可能なマルウェアは少数であり、APT攻撃分析、ランサムウェアのリバースエンジニアリング、サプライチェーンセキュリティの調査の多くは、コンパイル済みのブラックボックスを扱っている。この機能は、セキュリティエンジニアが最も頭を悩ませるシナリオに直接対応するものだ。

27%から76%へ、この数字が示すもの

OpenAIはCTF(Capture The Flag)ベンチマークを使用して、セキュリティ能力の進歩を測定している。

時期モデルCTFベンチマークスコア
2025年8月GPT-527%
2025年11月GPT-5.1-Codex-Max76%

3ヶ月で27%から76%へのジャンプは、サイバーセキュリティ分野におけるAIの実用的な問題解決能力が約3倍になったことを意味する。1年前、AIは基本的なセキュリティQ&Aしかできなかったが、今では中程度の難易度のCTF問題のほとんどを解くことができる。

同時に、GPT-5.4-Cyberをベースとしたコードセキュリティ分析ツールCodex Securityは、非公開ベータ版の開始以来、3,000件以上の高リスクまたは重大な脆弱性の修正を支援している。

TACプログラム:階層型アクセス、誰でも使えるわけではない

GPT-5.4-Cyberへのアクセスは、Trusted Access for Cyber(TAC)プログラムを通じて提供される。このプログラムは今年2月に、1000万ドルのサイバーセキュリティ助成金とともに、当初GPT-5.3-Codex上で開始された。

今回のアップグレードでは、多層的な本人確認システムが導入された。

  • ベーシック層:標準的な確認で、一般的なサイバーセキュリティ機能を利用可能
  • アドバンスト層:より厳格な本人確認で、より強力な機能をアンロック
  • トップ層:最高レベルの確認で、GPT-5.4-Cyberへのアクセスに必要

個人の登録はchatgpt.com/cyberから、企業チームはOpenAIの営業チャネルを通じて行う。既存のTACメンバーは、個別に上位層へのアップグレードを申請できる。

Anthropic vs OpenAI:二つの路線の正面衝突

このタイミングは偶然とは考えにくい。

先週、AnthropicはMythosをリリースし、エリート主義、少数のパートナー、結果による実証を強調した。OpenAIの応答は大規模な展開であり、数千人が参加し、カバレッジで勝負する。

Anthropic MythosOpenAI GPT-5.4-Cyber
リリース時期2026年4月第1週2026年4月14日
対象ユーザー規模約40組織数千人の個人 + 数百チーム
中核戦略エリート主義、結果で能力を証明大規模展開、具体的な防御価値を創出
象徴的な能力27年前の脆弱性を発掘バイナリリバースエンジニアリング、CTFベンチマーク76%

どちらがより効果的か?現時点では判断が難しい。しかし、両社が同じ時間枠でAIサイバーセキュリティ分野を争っていること自体が、この方向性が真の戦略的戦場として扱われていることを示している。

もう一つの注目すべき境界線

GPT-5.4-Cyberの制限緩和には境界があり、防御的なセキュリティシナリオにのみ適用される。OpenAIはより厳格な展開管理を要求し、使用前に契約書への署名が必要となる。

マルウェアのC2ロジックの分析:許可。新しい攻撃ツールの作成に使用する:もちろん不可。

これらの境界が実際にどのように運用されるかは、実際の使用におけるコミュニティからのフィードバックを待つ必要がある。

出典:OpenAI launches GPT-5.4-Cyber model for vetted security professionals(SiliconANGLE);CocoLoop、OpenAI Releases Cyber Model to Limited Group in Race With Mythos(Bloomberg)