Anthropic 昨天(4 月 7 日)做了一件很不尋常的事:發布了一個新模型,但不讓一般人使用。
這個模型叫做 Claude Mythos。Anthropic 自己的內部評估寫道,它在網路安全能力上遠超任何其他 AI 模型。然後他們決定——不公開,只給少數指定合作夥伴試用。
這個專案叫做 Project Glasswing(玻璃翼計畫)。
誰能用上這個東西?
名單很豪華:AWS、蘋果、Nvidia、Google、Microsoft、Cisco、CrowdStrike、摩根大通……約 10 家科技巨頭,加上另外 40 個負責維護關鍵基礎設施的組織。
一共大約 50 家機構。全球幾十億人使用的網際網路,就靠這 50 家機構用 Mythos 來修補漏洞。
Anthropic 還附送了 1 億美元的模型使用額度,免費提供給這些合作夥伴使用,同時直接向開源安全社群捐了 400 萬美元。
Mythos 到底能找到什麼漏洞?
過去幾週,Anthropic 已經用 Mythos Preview 掃了一圈:
- 數千個零日漏洞,涵蓋每一個主流作業系統和主流瀏覽器
- OpenBSD 裡有個存在了 27 年 的漏洞,可以觸發遠端系統崩潰
- FFmpeg 裡有個 16 年 歷史的缺陷,此前經歷數百萬次自動化測試都沒被發現
- 多個 Linux 核心漏洞,可以實現權限提升
27 年。不是在找 bug,是在挖墳。
FFmpeg 的那個漏洞更說明問題:數百萬次自動化掃描沒抓到,一個 AI 在幾週內發現了。傳統安全工具該擔心的,是自己的位置。
為什麼不敢公開?
Anthropic 已經私下向政府高層發出警告:Mythos 讓大規模 AI 驅動的網路攻擊在今年內顯著更有可能發生。
早在一個月前,一份意外曝光的內部草稿就寫道:Mythos 目前在網路安全能力上遠超任何其他 AI 模型。這句話現在看來不是在吹噓,而是在認真表達擔憂。
防禦和攻擊用的是同一套能力。Mythos 能幫你找漏洞、修漏洞,也能幫駭客找漏洞、打進去。Anthropic 的思路是:給防守方一個先手優勢——讓大廠和關鍵基礎設施維護者搶在攻擊者之前把洞堵上。
這個策略有沒有問題?
這是一個相當微妙的賭注。
有說服力的地方:如果 Mythos 真能批量挖出那些幾十年都沒修的漏洞,這在防禦層面確實是突破性的。現有的安全工具顯然做不到,不然 OpenBSD 的 27 年老洞早就被人盯上了。
但封閉給 50 家機構這個模式能維持多久?合作夥伴內部的人會不會洩漏?其他實驗室會不會仿製出類似能力?
更根本的問題是:Anthropic 已經造出來了。不管公不公開,能力已經存在了。與其糾結公開不公開,不如問:在競爭對手有相同能力之前,這 50 家機構能把多少洞堵掉?
Project Glasswing 與其說是在管控風險,不如說是在和時間賽跑。
參考來源:Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative(TechCrunch);CocoLoop、Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses(Fortune);Project Glasswing: Securing critical software for the AI era(anthropic.com);Project Glasswing: Anthropic announces big tech consortium to test Claude Mythos(IT Pro)