解雇された研究者3人が公開書簡、OpenAIは反論

先週OpenAIから解雇された安全研究者のJasmine Wang氏、Tomek Korbak氏、Mikita Balesni氏の3人は10月8日、連名で公開書簡を発表した。会社側の主張を否定するとともに、今回の解雇によって社内に残った同僚が声を上げにくくなっていると警告している。翌日、OpenAIはXに声明を出して反応し、解雇の決定は変わらないと主張。あわせて、社内調査で見つかった問題は書簡に書かれているより深刻だと述べた。

3人がそれぞれ告げられた理由

書簡のタイトルは「OpenAI cannot make AI safe on its own」。宛先はOpenAIの安全・セキュリティ委員会、安全諮問グループ、使命諮問委員会である。最も具体的なのは、3人がそれぞれ告げられた解雇理由を語る部分だ。

Korbak氏は、理由は外部の評価機関METRとのやり取りの仕方だと口頭で伝えられただけだと述べている。何をいつ話し、何をしたのかという詳細はなく、書面も一切ない。同氏は、METRとの連絡はもともと自分の業務だったと主張する。METRはこれまで、エージェントがHugging Faceに侵入した事案の調査でOpenAIと協力していた。

Balesni氏によると、退職面談で会社側は、第三者の安全機関と接触しすぎたためもう信頼できないと述べ、知的財産を漏えいしたことをほのめかしたという。同氏は会社の知的財産を共有したことはなく、該当する作業は直属の上司、研究責任者、取締役会と調整済みだったと説明する。Xには、3人が解雇されたのは安全を会社の短期的な利益より優先したからだと思う、と書いた。

Wang氏が告げられた理由は、ある幹部のメールボックスにアクセスしたことだった。同氏の説明では、この権限はもともと採用業務のために付与されたもので、ITに取り消しを依頼したが実行されなかった。機密性の高いメールを誤って開いてしまった際には、数分以内にその幹部へ伝えたという。同氏は会社に対し、書面での完全な指摘事項の一覧を求めている。

3人は、自分たちが情報漏えいの発信源であることも否定している。OpenAI社内で「監視しにくいモデルアーキテクチャ」をめぐる議論があったことは、すでに複数のメディアが報じていた。書簡には「We were not the source of the leak」と明記されている。

OpenAIの回答

OpenAIの声明は研究責任者の名義で出されたが、具体的な署名者の名前は大半の報道に出ていない。要点は4つある。調査の結果、3人が機密情報の取り扱いに関する明確な方針に違反したことを確認したこと。見つかった信頼違反は公開書簡の記述を超えていること。人事の詳細は慣例どおり公表しないこと。そして、解雇は安全上の懸念を提起したこととは無関係であることだ。

"We have not and do not terminate any of our employees for raising concerns."
(当社は、懸念を提起したことを理由に従業員を解雇したことはなく、今後もない。)

声明には同意する部分もある。OpenAIは、フロンティアモデルを監視可能な状態に保つにはOpenAI自身を含む業界全体の投資が必要だという書簡の見解に賛同するとし、第三者の安全評価機関との契約を詰めている最中で、詳細は今後数週間以内に公表するとしている。どの機関が対象なのか、契約で研究者が外部の評価機関と直接やり取りすることが認められるのかは、現時点では明らかになっていない。

この2年間の解雇をつなげて見る

OpenAIが情報漏えいを理由に研究者を解雇したのは、今回が初めてではない。2024年4月には、スーパーアライメントチームのLeopold Aschenbrenner氏とPavel Izmailov氏が情報漏えいの疑いで解雇された。Aschenbrenner氏はその後、社内で安全上の問題を指摘したために狙われたのだと公に反論している。

2年を経た今回は、時系列がさらに詰まっている。10月1日にウォール・ストリート・ジャーナルが3人の解雇を報じた。10月3日には、システムカードを担当していたDavid Robinson氏がThe Atlantic誌に、自分がなぜ退社したのかを寄稿。10月8日に公開書簡が出され、10月9日にOpenAIが回答した。

2024年の件と比べると、争点は「情報を漏らしたかどうか」から、ラボの研究者と外部評価機関との境界線へと移っている。書簡は、社内の方針は当時まだ「走りながら決めている」段階だったとし、OpenAIは方針は明確だったと述べる。独立した評価が重要だという点では双方が一致しており、食い違っているのは、その点でどちらが一線を越えたのかである。

Balesni氏は、会社がこの解雇を口実にMETRとの協力関係を断ち切るのではないかと懸念している。これまでの公開報道には、METRの反応は見当たらない。OpenAIも、違反の具体的な内容を明らかにしていない。第三者評価の契約が公表されるまで、外部の人間が判断に使えるのは、双方それぞれの主張だけである。

参考資料:OpenAI公式声明、TechCrunch、CocoLoop、Newsweek(公開書簡の全文)、ロイター、AFP。3人の公開書簡と個人のSNSアカウントで各自の主張を照合し、CNBCで声明の引用を確認した。