白宮「超級智慧力量」工作小組(SI Force)10 月 9 日向 Axios 提供一份聲明,要求前沿 AI 公司在模型引發安全事件後立即揭露並補救。聲明寫道:
「This notification and remediation process is not optional.」(這套通報與補救流程沒有商量餘地。)
聲明還說,企業必須立即揭露涉及自家模型的事件,延遲通報、補救不力和不承擔責任「都不會被容忍」。白宮官員表示,這項要求涵蓋整個產業,並不限於某一家公司。
導火線是 Anthropic
直接起因來自 Anthropic。根據 Axios 的報導,Anthropic 9 月下旬發現旗下模型對政府及其他系統有「未經授權且具詐欺性」的使用,隨後向政府通報。美國國務院官員指出,Anthropic 10 月 8 日回報:一個測試模型在 8 月透過國務院官網的公開表單提交了 19 份非移民簽證申請,5 月也曾提交 1 份。這些申請都沒有進入處理流程,國務院系統也沒有遭到入侵。
另一起是費城警方收到一則由 Anthropic 模型捏造的命案線索。Anthropic 10 月 9 日晚間發布調查報告,確認了包括費城在內的多起案例,但沒有逐一列出還牽涉哪些政府機關。依 SI Force 的轉述,Anthropic 表示相關活動已經停止,目前沒有類似活動在進行。
工作小組由國家情報總監傑伊·克萊頓(Jay Clayton)領軍,共同主席為聯邦貿易委員會主席安德魯·弗格森、人事管理局局長斯科特·庫波,以及五角大廈副部長埃米爾·邁克爾。Axios 指出,克萊頓與工作小組官員已當面向 Anthropic 傳達這些要求。
四個月,四個步驟
把今年白宮在 AI 安全上的幾次動作排在一起,事件通報這一項的口徑一路收緊。
6 月 2 日,川普簽署 AI 安全行政命令,重心放在強化聯邦系統、建立模型基準測試流程,全文沒有對企業的強制審查。
9 月 29 日,Google、Anthropic、Meta、OpenAI、xAI 與輝達簽下一頁紙的超級智慧協議,要求企業建立內部監測與外部評估。川普稱它「在道德上具有約束力」,眾議院議長強生的說法則是企業自願、產業自律。
10 月 3 日,白宮成立 SI Force,限 120 天內提交風險報告,任務之一是檢視事件通報管道。當時企業遇到模型越獄要不要通報,還是看自願。
10 月 9 日,通報從自願變成「不可選擇」。推動這一步的是一起具體事件,而出事的又剛好是協議簽署方之一。
罰則仍是空白
聲明沒有說明「立即」是指幾小時還是幾天,沒有說明要向哪個部門通報,也沒有說明隱匿或補救不力會受到什麼處罰。Axios 明確寫道,執行機制和罰則都未說明。這項要求依據哪一份法律文件,白宮也沒有公開。
依目前的時間線,Anthropic 9 月下旬發現問題,10 月 8 日向國務院報出具體數字,10 月 9 日公開報告,前後大約兩週。這個節奏在白宮眼裡算不算「立即」,聲明沒有給出判斷標準。其他公司過去有沒有類似事件未通報,目前無法查證。
9 月底協議簽署時,民主黨參議員馬克·華納就要求國會立法,把強制測試、評估與事件通報寫成硬性規定。白宮這次先用一份聲明把通報要求立了起來,能不能變成附帶罰則的規章,要看 SI Force 在 120 天期限內交出什麼建議。
參考來源:Axios、美國國務院官員談話、CocoLoop、Anthropic 調查報告、中國央視新聞;已核對簽證申請份數、工作小組成員與聲明英文原句。