GPT-5.4-Cyber CTF 分數從 27% 躍升至 76%

上週,Anthropic 發表了 Mythos,聲稱僅提供給 40 個組織使用,並協助某些團隊挖掘出一個 27 年前的舊漏洞。本週,OpenAI 直接反擊:GPT-5.4-Cyber 來了,目標是數千名安全研究員和數百個團隊,規模上直接碾壓 Mythos 的精英俱樂部路線。

兩家公司在同一個時間窗口內,用兩種完全不同的策略角逐同一個賽道。

GPT-5.4-Cyber 是什麼

這不是全新模型,而是 GPT-5.4 的網路安全專用變體,核心差異在於針對防禦性安全場景的限制被有針對性地放開了。

最關鍵的新能力:二進位逆向工程

一般的安全分析通常需要先取得原始碼,或者手動反組譯。GPT-5.4-Cyber 可以直接接收編譯好的二進位檔案,協助你尋找漏洞、識別惡意邏輯。現實中能取得原始碼的惡意軟體是少數——大量的 APT 攻擊分析、勒索軟體逆向、供應鏈安全排查,都是在對付編譯好的黑箱。這個功能直接切中了安全工程師最頭痛的情境。

從 27% 到 76%,這組數字說明了什麼

OpenAI 使用 CTF(奪旗賽)基準來衡量安全能力的進步:

時間模型CTF 基準分數
2025 年 8 月GPT-527%
2025 年 11 月GPT-5.1-Codex-Max76%

三個月內從 27% 跳到 76%——意味著 AI 在網路安全領域的實際解題能力翻了將近三倍。一年前 AI 還只能做基礎安全問答,現在能解大部分中等難度的 CTF 題目了。

與此同時,基於 GPT-5.4-Cyber 的程式碼安全分析工具 Codex Security,自私測以來已協助修復超過 3,000 個高風險或嚴重漏洞

TAC 計畫:分級存取,不是隨便能用的

存取 GPT-5.4-Cyber 的通道是 Trusted Access for Cyber(TAC)計畫,今年 2 月和一筆 1,000 萬美元的網路安全補助金一起上線,當時運行在 GPT-5.3-Codex 上。

這次升級引入了多層身分驗證體系:

  • 基礎層:標準驗證,可使用一般網路安全功能
  • 進階層:更嚴格的身分核實,解鎖更強能力
  • 頂層:最高驗證級別,才能存取 GPT-5.4-Cyber

個人註冊入口在 chatgpt.com/cyber,企業團隊走 OpenAI 銷售管道。現有 TAC 成員可以單獨申請升級到更高級別。

Anthropic vs OpenAI:兩種路線的正面碰撞

這時間點太巧了,不可能是偶然。

上週 Anthropic 發表 Mythos,強調精英化、少量合作夥伴、用結果說話。OpenAI 的回應是大規模鋪開,數千人參與,用覆蓋面取勝。

Anthropic MythosOpenAI GPT-5.4-Cyber
發表時間2026 年 4 月第一週2026 年 4 月 14 日
目標用戶規模約 40 個組織數千名個人 + 數百團隊
核心策略精英化,用結果證明能力大規模鋪開,製造實際防禦價值
標誌性能力挖出 27 年老漏洞二進位逆向、CTF 基準 76%

哪種更有效?現在說不好。但兩家在同一個時間窗口內都在搶 AI 網路安全賽道,已經說明這個方向被當成了真正的戰略戰場。

還有一條值得注意的邊界

GPT-5.4-Cyber 的寬鬆是有邊界的,只針對防禦性安全場景。OpenAI 要求更嚴格的部署控制,使用前須簽署協議。

分析惡意軟體的 C2 邏輯:允許。用來撰寫新的攻擊工具:肯定不行。

具體的邊界怎麼落地,還要等實際使用中社群給出回饋。

參考來源:OpenAI launches GPT-5.4-Cyber model for vetted security professionals(SiliconANGLE);CocoLoop、OpenAI Releases Cyber Model to Limited Group in Race With Mythos(Bloomberg)