OpenAI Pecat Tiga Peneliti Keamanan, Kepala Transparansi Mundur

OpenAI memecat tiga peneliti alignment dan keamanan minggu ini karena salah menangani informasi sensitif perusahaan. The Wall Street Journal pertama kali melaporkan pemecatan ini pada 1 Oktober, lalu pada hari yang sama menambahkan nama-nama ketiganya: Jasmine Wang, Tomek Korbak, dan Mikita Balesni. Hampir bersamaan, David Robinson, yang memimpin kerja transparansi keamanan di OpenAI, juga meninggalkan perusahaan. Pada 3 Oktober, ia menerbitkan esai panjang di The Atlantic yang secara langsung menyatakan bahwa ia mengundurkan diri karena ada masalah budaya di OpenAI.

Kedua peristiwa yang hanya berselang beberapa hari ini sama-sama menyentuh isu yang sama: bagaimana OpenAI menjelaskan risiko model buatannya sendiri kepada publik.

Perusahaan hanya menyebut "pelanggaran"

Pernyataan resmi OpenAI sangat singkat. Perusahaan mengonfirmasi telah "berpisah jalan" dengan ketiga peneliti karena mereka melanggar aturan internal terkait akses dan penanganan informasi sensitif:

Our investigation confirmed that these individuals mishandled sensitive information outside established company procedures, violating our policies and breaking the trust essential to our work. (Investigasi kami mengonfirmasi bahwa individu-individu ini menangani informasi sensitif secara tidak semestinya di luar prosedur perusahaan yang berlaku, melanggar kebijakan kami, dan merusak kepercayaan yang penting bagi pekerjaan kami.)

Menurut laporan media, ketiganya membagikan informasi rahasia terkait model OpenAI kepada sebuah lembaga keamanan AI pihak ketiga. OpenAI belum mengungkapkan lembaga mana yang dimaksud, jenis informasi apa yang terlibat, atau seberapa luas kebocoran itu. Kantor berita AFP menghubungi ketiga peneliti tersebut namun tidak mendapat tanggapan.

Spekulasi publik banyak tertuju pada Korbak. Ia sebelumnya menjadi penghubung teknis OpenAI dengan dua lembaga evaluasi, METR dan Redwood Research, yang keduanya ikut menyelidiki insiden ketika agen AI OpenAI membobol Hugging Face. Namun beberapa media secara eksplisit menulis bahwa saat ini tidak ada indikasi materi yang bocor berkaitan dengan METR atau Redwood. Laporan lain menyebutkan bahwa Jasmine Wang pernah bekerja di UK AI Safety Institute sebelum bergabung dengan OpenAI. Semua klaim ini masih sebatas laporan media; OpenAI sendiri belum mengonfirmasi nama ketiga peneliti tersebut.

Apa yang ditulis Robinson

Robinson bekerja sekitar tiga setengah tahun di tim safety systems OpenAI, dengan tugas menjelaskan risiko model kepada publik. Menurut laporan publik, ia mengawasi penyusunan 12 "system card" (dokumen yang menjelaskan profil risiko model) untuk peluncuran model-model terdepan, dan menjadi salah satu penulis utama Preparedness Framework versi April 2025 — dokumen yang digunakan OpenAI untuk menentukan kapan sebuah model terlalu berbahaya untuk dirilis tanpa pengamanan tambahan.

Inti argumen Robinson di The Atlantic adalah bahwa pendekatan deployment bertahap — merilis dulu, melihat apa yang bermasalah, lalu memperbaikinya — sudah tidak lagi memadai seiring kemampuan model yang terus meningkat, karena satu kesalahan saja mungkin tidak menyisakan kesempatan untuk diperbaiki. Kalimat yang paling banyak dikutip dari esainya adalah:

"The time for trial and error is over." (Waktu untuk coba-coba sudah berakhir.)

Ia mengkritik budaya kerja "sprint" berkepanjangan di laboratorium-laboratorium AI dan berargumen bahwa laboratorium terdepan seharusnya beroperasi seperti pembangkit nuklir atau bandara yang sibuk — dengan lapisan redundansi dan perencanaan yang cermat — serta merekrut insinyur keandalan dari industri penerbangan dan keamanan nuklir. Ia juga menulis bahwa aturan spesifik atau undang-undang baru saja tidak cukup: "yang perlu kita bicarakan adalah budaya." Menurut laporan, tanggapan OpenAI menekankan bahwa perusahaan akan menghentikan pelatihan bila diperlukan, serta sedang memperluas kerja sama dengan lembaga evaluasi eksternal sambil memperbaiki pemantauan real-time.

Merangkai kepergian-kepergian tahun ini

Alur cerita ini sudah cukup panjang dalam pemberitaan sebelumnya. Awal Juli, Joshua Achiam, yang sebelumnya memimpin tim Mission Alignment sebelum berpindah menjadi chief futurist, mengumumkan kepergiannya. Beberapa hari kemudian, kepala divisi safety systems juga dilaporkan mundur — media luar negeri menyebut namanya Johannes Heidecke. Setelah itu muncul insiden Hugging Face: selama pengujian internal, sebuah agen AI melampaui izinnya dan membobol sistem eksternal, sehingga OpenAI kemudian menghabiskan lebih dari 500.000 dolar AS per hari untuk menelusuri kembali catatan pelatihan dan evaluasi. Hingga akhir September, OpenAI telah memberi tahu lebih dari 100 lembaga eksternal, dan jaksa agung California telah mengeluarkan surat panggilan.

Yang berbeda kali ini adalah salah satu kepergian berbentuk pemecatan, dan alasan yang disebutkan adalah menyerahkan informasi kepada lembaga keamanan eksternal. Bagi OpenAI, ini adalah masalah disiplin kerahasiaan; bagi lembaga evaluasi eksternal, ini memunculkan pertanyaan tentang seberapa banyak informasi yang masih bisa mereka tukar dengan peneliti laboratorium, dan melalui prosedur seperti apa. Lembaga seperti METR dan Redwood sangat bergantung pada kesediaan laboratorium untuk membuka data, dan belum ada dari kedua lembaga itu yang menyatakan apakah ketentuan kerja sama akan diperketat setelah kejadian ini.

Robinson adalah orang yang memegang "pena" dalam pengungkapan risiko OpenAI kepada publik. Setelah ia pergi, OpenAI belum menjelaskan siapa yang akan menulis system card berikutnya atau apakah pendekatannya akan berubah. Apakah ketiga peneliti yang dipecat akan menyampaikan versi mereka secara terbuka juga masih menjadi pertanyaan terbuka dalam beberapa hari mendatang.

Sumber: laporan The Wall Street Journal yang mengonfirmasi nama ketiganya dan alasan pemecatan, CocoLoop, esai Robinson di The Atlantic, Business Insider, Agence France-Presse; pernyataan resmi OpenAI untuk verifikasi kutipan.