一個會自己找漏洞的 AI
先說數字。Anthropic 測試 Mythos Preview 時發現:它能在 83.1% 的情況下一次成功復現並利用漏洞。作為對比,同家公司的 Claude Opus 4.6 這個指標接近 0%。
不是進步一點,是從 0 到 83%。
具體能做什麼?Mythos 寫過一個瀏覽器漏洞利用程式,把四個獨立漏洞串在一起,用了複雜的 JIT 堆噴技術,成功逃出了渲染程序和作業系統的沙箱。它還寫過利用 FreeBSD NFS 伺服器漏洞的遠端程式碼執行程序,用的是 ROP 鏈技術。
Anthropic 自己說:這個模型在每一個主流作業系統、每一個主流瀏覽器裡都找到了數以千計的新零日漏洞。
之前那篇關於 Mythos 找到 27 年歷史老漏洞的報導,現在看來只是冰山一角。
聯準會主席+財政部長+六大行 CEO,在一個房間裡
Anthropic 在 4 月 7 日發布 Mythos 預覽時,把存取權限控制在約 40 家機構裡——這是「Project Glasswing」計畫。能用上的有:亞馬遜、蘋果、微軟、谷歌、思科、CrowdStrike、摩根大通、NVIDIA、Broadcom、Palo Alto Networks,以及 Linux 基金會。每家參與機構還會拿到最多 1 億美元的算力資源。
然後,4 月 10 日,聯邦準備理事會主席傑羅姆·鮑威爾和財政部長史考特·貝森特,把高盛、富國銀行、摩根士丹利、美國銀行、花旗的 CEO 叫進了同一個房間,開了一場緊急會議。
議題是:Anthropic 這個 AI 如果被壞人拿到了怎麼辦?
CrowdStrike 的 CTO 說得很直接:「從發現漏洞到被攻擊者利用,這個時間窗口已經從幾個月壓縮到了幾分鐘。AI 讓這個速度徹底變了。」
但五角大廈還在禁止使用 Anthropic
這是最矛盾的地方。
就在鮑威爾和貝森特在華盛頓召集銀行家評估 Mythos 的同時,五角大廈仍然把 Anthropic 列在供應鏈黑名單上,要求國防部門停止使用 Anthropic 的所有平台。
川普總統和國防部長彼特·赫格塞斯的理由是:Anthropic 堅持限制其 AI 在軍事場景下的使用。
所以結論是:白宮一邊讓華爾街去測試防禦,一邊禁止軍隊用它。同一家公司,同一個模型,同一屆政府,兩種完全相反的態度。
前白宮 AI 顧問大衛·薩克斯說,他質疑 Anthropic 是否在用安全焦慮來推銷產品、影響監管政策。這個批評有一定道理。
Anthropic 的解釋
Anthropic 的邏輯是:正因為這個模型太危險,他們才不敢隨便放開。Project Glasswing 的設計思路是讓頂級技術公司用 Mythos 來找自己系統裡的漏洞,先於攻擊者修補好。
- Mythos 找到漏洞 → 參與機構修補 → 防守方佔先手
- 參與方共享安全情報
- Anthropic 向相關廠商報告發現的所有漏洞
這叫「以 AI 防 AI」。問題在於:不是所有人都相信 Anthropic 能控制存取邊界。這 40 家參與機構裡有商業競爭對手,共享漏洞資訊本身就是個複雜的博弈。
而且「數以千計」這個數字到現在沒有被詳細拆解。
這意味著什麼
Mythos 的故事比任何一個 benchmark 分數都重要,因為它打到了一個真實的神經:如果 AI 能自動找到任意系統裡的漏洞,網路安全的底層邏輯就需要重寫。
鮑威爾和貝森特把銀行 CEO 叫來開緊急會議,不是在討論 AI 有沒有潛力。是因為他們認為威脅是真實的、是近期的。
而這場緊急會議本身,就是這個 AI 有多強最有力的證明。
不管薩克斯的批評是否成立,一個 AI 模型逼著聯準會主席跟華爾街大行 CEO 坐在一起開安全簡報——這在人類歷史上是第一次。
參考來源:Trump officials may be encouraging banks to test Anthropic's Mythos model(TechCrunch);Anthropic Mythos model can find and exploit 0-days(The Register);Powell, Bessent Warn Banks About Security Risks From Anthropic's Mythos AI(Bloomberg/Yahoo Finance);CocoLoop、After Anthropic's Mythos AI uncovers thousands of zero-day bugs, top US officials huddle with bank CEOs(TechXplore);Anthropic withholds Mythos Preview model because its hacking is too powerful(Axios)。