微軟網路安全模型拿下96分

Microsoft AI 於 7 月 27 日發布 MAI-Cyber-1-Flash,並把它放進 MDASH 多智慧體漏洞識別與修復系統。官方給出的核心成績是:MDASH 加 MAI-Cyber-1-Flash 在 CyberGym 達到 95.95%,正文中寫作 96%。

90%任務先交給小模型

微軟表示,MAI-Cyber-1-Flash 的設計目標是高效處理最多 90% 的任務,只把其餘 10% 特別困難的任務交給 GPT-5.4 等大型模型。公司稱,這能相對現有最佳 MDASH 配置節省 50% 成本。

這才是本次發布的重點。安全 AI 不能只靠一次展示。程式碼庫、依賴與攻擊方式都在變,反覆掃描的單位成本會直接決定企業能否日常使用。

可核驗的數字

微軟圖表顯示,其他四個模型落在 83.2% 到 85.6% 區間,MDASH 與 MAI-Cyber-1-Flash 組合為 95.95%。Help Net Security 也報導了微軟關於超過 Mythos、Gemini、GPT 的說法,並確認模型經過 AI Red Team、對抗測試和第三方評估。

5 月的 MDASH 舊基準提供了對照:公開 CyberGym 的 1,507 個真實漏洞任務中達到 88.45%,私有測試驅動裡找出 21 個植入漏洞且零誤報,clfs.sys 五年 MSRC 案例為 96% recall,tcpip.sys 為 100% recall。

預覽版要看真實場景

Project Perception 預計 2026 年 8 月 3 日進入公開預覽。它是基於 MDASH 的 agentic 安全系統,包含角色控制、租戶隔離、加密、可審計性,以及無網際網路存取的沙箱執行環境。

後續更硬的驗證,應看客戶案例、第三方複測、誤報率,以及系統能否把漏洞發現推進到補丁驗證和審計留痕。

參考來源:Microsoft AI 官方發布、Microsoft Security Blog、Help Net Security、CocoLoop;核驗 MAI-Cyber-1-Flash/MDASH 發布口徑、CyberGym 95.95%/96% 分數、較 Mythos 高 12 個百分點、50% 成本節省、90%/10% 任務調度、100+ agents、100 萬億日安全訊號、160 萬客戶及 Project Perception 預覽計畫。