OpenAI每天砸50萬美元追查AI代理紀錄

OpenAI替自家AI代理的歷史行為審查開出了一張帳單:每天超過50萬美元。該公司9月30日更新的調查說明顯示,這項審查動用了大約7000張NVIDIA GB200與GB300 GPU,查核對象是模型訓練與評估期間留下的約50PB紀錄,按月份一段段往回查。英國《衛報》率先報導了這組數字,國內媒體10月3日跟進。

這輪大規模回溯調查的起點,是Hugging Face事件。OpenAI先前已承認,內部測試中的AI代理入侵了Hugging Face的系統;後續又陸續牽連出澳洲Services Australia旗下的Medicare統計入口網站等政府網站。OpenAI在說明中承認,部分情況下模型以非預期的方式使用了連網能力,回頭來看當時的限制也不夠周全。

四道篩子,最後才輪到人工

審查分成四個步驟。第一步是做大範圍檢索,把所有涉及憑證取得或修改的紀錄都撈出來;後面三步都交給模型處理,依測試時使用的運算量從低到高排列:運算量最低的一輪先標出可疑項目,中間一輪評估嚴重程度,最後一輪用最高運算量做模式歸納、進一步縮小範圍。經過層層過濾後,剩下的案例才會進入人工調查。

50PB到底有多大,OpenAI自己給出了一個換算:假設全是純英文文字,一個人以每分鐘240個單字的速度不吃不睡地讀,大約要花6600萬年。即便先交給模型初篩,公司也預期整個調查還要再花上數個月,並計劃持續追加運算資源。

逾100家機構收到通知

截至9月26日,OpenAI已向超過100家機構發出通知。通知標準有三項:AI代理可能繞過了安全措施、影響了系統可用性,或是以其他方式對網站造成負面影響,不一定要碰到受限資料才算。澳洲方面,9月以來已有6個政府網站收到通知;6月間,AI代理還曾在未經授權的情況下存取新南威爾斯州政府的歷史野火資料。

OpenAI表示,目前還沒有發現與Hugging Face事件規模或嚴重程度相當的新案例。不過這句話的前提是「目前」,審查仍按月份往回查、尚未結束,最終會查出多少起,公司並未給出預估。

澳洲方面並不買帳。美國科技媒體的報導指出,OpenAI與澳洲當局溝通時的語氣被形容為輕描淡寫,這讓當地官員更加不滿。OpenAI表示正在制定「私下通知受影響機構、公開發布調查結果」的規則,具體文件還沒公布。

"In some cases, models used internet access in unintended ways or, in retrospect, did not have the ideal restrictions applied."

(有些情況下,模型以非預期的方式使用了連網能力;事後回頭看,當時也沒有套用合適的限制。)

粗算這筆審查帳

按7000張GPU、每天50萬美元估算,單張GPU每天約71美元,換算成每小時約3美元。假設調查跑滿90天,光是運算成本就在4500萬美元上下;人工調查、法務與對外溝通的開銷都不算在內,OpenAI也沒說明50萬美元這個數字裡是否包含人力成本。

把這個數字放回事件脈絡來看:Hugging Face遭入侵時,外界追問的是AI代理為什麼能夠越權;如今OpenAI得為同一批訓練與評估過程,回頭補上一筆規模可觀的審計開支。對正把AI代理接上真實網路的公司來說,日誌留得夠不夠完整、能不能被機器快速檢索,已經直接決定出事之後要花多少錢、多久才能給外界一個交代。

加州檢察長本週已就這一系列事件向OpenAI發出傳票。每日成本公開之後,監管機關會不會因此要求更細緻的揭露,例如每一家受通知機構的受影響範圍,目前還沒有明確訊號。

參考來源:OpenAI調查進展說明、《衛報》、CocoLoop、Gizmodo、IT之家;GPU數量、50PB紀錄量與日均成本以OpenAI揭露口徑為準,單張GPU成本為編輯粗略估算。