遭開除三名研究員發公開信,OpenAI另指失信

上週遭 OpenAI 開除的三名安全研究員 Jasmine Wang、Tomek Korbak 與 Mikita Balesni,於 10 月 8 日聯名發出公開信,否認公司對他們的指控,並警告這次開除已讓留在公司的同事不敢發聲。一天後,OpenAI 在 X 上發表聲明回應,堅持開除決定不變,同時表示內部調查發現的問題比信中所寫的更嚴重。

三個人各自被告知了什麼

公開信的標題是「OpenAI cannot make AI safe on its own」,收件對象為 OpenAI 的安全與保障委員會、安全顧問小組與使命顧問委員會。信中最具體的部分,是三人分別說明自己被告知的開除理由。

Korbak 說,他只被口頭告知,原因是他與外部評估機構 METR 的溝通方式,至於具體說了什麼、做了什麼、發生在何時,都沒有細節,也沒有任何書面資料。他認為與 METR 溝通本來就是他的工作。METR 先前曾與 OpenAI 合作調查智慧代理入侵 Hugging Face 的事件。

Balesni 說,離職面談時公司表示,因為他與第三方安全機構接觸過多而不再信任他,並暗示他洩漏了智慧財產。他表示自己從未分享公司的智慧財產,相關工作也已與直屬主管、研究負責人及董事會協調過。他在 X 上寫道,自己認為三人被開除,是因為把安全放在公司的短期利益之前。

Wang 被告知的理由是存取了一位高階主管的信箱。她的說法是,這項權限當初是為招募工作開通的,她請 IT 部門撤銷卻沒被執行;誤開一封敏感郵件後,她在幾分鐘內就告知了那位主管。她要求公司提供書面、完整的指控清單。

三人也否認自己是洩密的源頭。先前曾有媒體報導 OpenAI 內部關於「更難監控的模型架構」的討論,信中明確寫道「We were not the source of the leak」。

OpenAI 如何回應

OpenAI 的聲明由研究負責人發出,多數報導並未提到具體署名者。重點有四項:調查後確認三人違反了處理敏感資訊的明確政策;發現的失信行為超出公開信所述;人事細節依慣例不公開;開除與他們提出安全疑慮無關。

"We have not and do not terminate any of our employees for raising concerns."
(我們沒有、也不會因為員工提出疑慮而開除任何人。)

聲明中也有認同之處。OpenAI 表示同意信中「維持前沿模型的可監控性需要全產業投入,包括 OpenAI 自己」的看法,並稱正在敲定與第三方安全評估機構的合約,細節將在未來幾週公布。究竟是哪幾家機構,合約是否允許研究員與外部評估方直接交流,目前都不清楚。

把這兩年的幾次開除串起來看

OpenAI 以洩密為由開除研究人員,這不是第一次。2024 年 4 月,超級對齊團隊的 Leopold Aschenbrenner 與 Pavel Izmailov 因涉嫌洩漏資訊被開除,Aschenbrenner 事後同樣公開反駁,稱自己是因為在內部提出安全問題而遭針對。

兩年後的這一輪,時間線壓得更緊:10 月 1 日《華爾街日報》報導三人遭開除;10 月 3 日,負責系統卡的 David Robinson 在《大西洋月刊》撰文說明自己為何離開;10 月 8 日公開信發出;10 月 9 日 OpenAI 回應。

與 2024 年那次相比,這次爭議的焦點從「有沒有洩密」轉移到實驗室研究員與外部評估機構之間的界線。信中說內部政策當時還在「邊做邊定」,OpenAI 則說政策是明確的。雙方都同意獨立評估很重要,分歧在於這件事上是誰越了線。

Balesni 擔心公司會藉這次開除切斷與 METR 的合作關係。目前公開報導中尚未見到 METR 的回應,OpenAI 也沒有揭露違規的具體內容。在第三方評估合約公布之前,外界能拿來判斷的,只有雙方各自的說法。

參考來源:OpenAI 官方聲明、TechCrunch、CocoLoop、Newsweek 公開信全文、路透社、法新社;三人公開信與個人社群帳號用以核對各自陳述,CNBC 用以核對聲明引語。