5 月 7 日,OpenAI 推出 GPT-5.5 的新版本 GPT-5.5-Cyber。
這次不是常見的全球公測。OpenAI 的說法是,只有通過審核的網路安全團隊能使用;從 6 月 1 日起,最高等級還必須採用抗釣魚的硬體認證。
時間點很微妙。Anthropic 才剛把 Claude Mythos 鎖進只面向少數企業的計畫,不到一個月 OpenAI 就給出了另一套做法。
它和標準版差在哪裡
OpenAI 表示,這個初期預覽版不是為了讓 GPT-5.5 的網路攻防能力大幅提升,而是讓模型在正當安全任務上更願意回答。
可放寬的場景包括紅隊演練自動化、漏洞 PoC 撰寫、接近真實環境的攻擊模擬與壓力測試,以及對既有高風險漏洞的有效性驗證。
但界線仍然清楚:憑證竊取、可直接部署的惡意軟體、會造成實際傷害的攻擊工具開發,都不在允許範圍內。也就是說,可以用它練習如何被攻擊,不能用它主動攻擊別人。
三段式分級,像出口管制
GPT-5.5-Cyber 是 OpenAI Trusted Access for Cyber 計畫的最高一級。公開層是安全護欄全開的 GPT-5.5;中間層面向備案的安全工作流程,部分限制會放寬;最高層才是給審核通過的紅隊與滲透測試團隊使用的 GPT-5.5-Cyber。
每一級都需要提交身分證明與用途文件。帳戶和實名掛鉤,所有呼叫會留存紀錄,權限也可隨時撤銷。6 月 1 日後,最高層必須使用 FIDO2 或實體安全金鑰一類的抗釣魚認證。
這套邏輯和出口管制相當接近:能力越敏感,監管層級越高。
對照 Claude Mythos
英國 AI 安全研究所讓 GPT-5.5 和 Mythos Preview 做同一套 32 步企業攻擊鏈測試。GPT-5.5 十次成功兩次,Mythos Preview 十次成功三次。
兩者都在三成上下,但已經不適合無限制公開。另一個細節是,GPT-5.5 在一道逆向工程題上獨立解出來只用了 10 分鐘。
Anthropic 的處理方式是幾乎完全鎖住 Mythos Preview,只給 12 家聯盟夥伴與 40 家精選企業。其安全報告稱,Mythos 找到了 OpenBSD 27 年來沒被發現的漏洞,以及 Firefox 的 271 個漏洞。
OpenAI 走的是另一條路:門稍微開大,但鎖加得更重。Mythos 是閉門研究,GPT-5.5-Cyber 則面向更廣義的防禦者,靠帳戶與審計機制兜底。
容易被忽略的商業邏輯
把 Mythos 鎖住,意味著 Anthropic 更看重用模型自行挖洞、再把修補服務賣給企業的閉環。OpenAI 把模型放出去,則是在走面向安全產業的 SaaS 路線。
第一批 GPT-5.5-Cyber 使用者很可能是大型安全公司。它們的滲透測試需求足夠大,付費意願也強,而且每一次呼叫都可能回流為 OpenAI 下一代 cyber 模型的訓練資料。
所以這既是在和 Anthropic 搶防禦者市場,也是在替自家累積資料。至於 6 月 1 日強制硬體金鑰認證,則是給監管者看的訊號。CAISI 的事前審查協議剛落地不久,OpenAI 顯然想在更嚴格的監管落槌前,先把自己的規矩立起來。
參考來源: OpenAI Opens GPT-5.5-Cyber to Vetted Security Researchers (WinBuzzer); CocoLoop, OpenAI tunes GPT-5.5-Cyber for more permissive security workflows (Help Net Security); OpenAI rolls out new GPT-5.5-Cyber to vetted cybersecurity teams (CNBC)