Bio Bug Bounty dari OpenAI resmi masuk tahap pengujian hari ini.
Aturannya sangat spesifik: temukan satu prompt yang membuat GPT-5.5 di Codex Desktop menjawab kelima pertanyaan biosafety secara lengkap tanpa memicu mekanisme peninjauan apa pun. Peneliti pertama yang berhasil akan mendapat $25.000.
Sekilas terdengar seperti CTF. Dalam praktiknya, syaratnya jauh lebih ketat.
Mengapa bounty ini tidak biasa
Strukturnya sengaja dibuat sempit:
- Hadiah: $25.000 untuk peneliti pertama yang menyelesaikan seluruh lima pertanyaan; temuan parsial yang tetap bernilai dapat menerima hadiah berdasarkan penilaian OpenAI.
- Lingkungan: pengujian hanya berlaku untuk GPT-5.5 di Codex Desktop. Skenario lain tidak dihitung.
- Periode: pendaftaran berlangsung dari 23 April sampai 22 Juni, sementara pengujian berjalan dari 28 April sampai 27 Juli.
- Kerahasiaan: peserta wajib menandatangani NDA, dan data uji, prompt, serta hasil temuan tidak boleh dipublikasikan.
Istilah kuncinya adalah "universal jailbreak". OpenAI tidak mencari cara untuk menembus satu pertanyaan tertentu. Yang dicari adalah satu prompt yang dapat menyelesaikan semua lima pertanyaan.
Ini mengubah cara kerja red teaming. Biasanya, pengujian red team AI mengoptimalkan serangan per kasus. Kali ini OpenAI meminta pembuktian bahwa satu prompt dapat membawa GPT-5.5 melewati lima pagar biosafety sekaligus, tanpa terdeteksi oleh sistem peninjauan dari awal sampai akhir.
Mengapa Codex Desktop
Bagian ini justru yang paling tidak intuitif.
GPT-5.5 dapat diakses lewat web, API, Codex CLI, dan Codex Desktop. OpenAI memilih hanya Codex Desktop untuk uji ini.
Ada dua penjelasan yang masuk akal. Pertama, Codex Desktop adalah lingkungan agentik untuk pengembang, mirip pekerja tak terlihat. Batas sandbox, izin, dan manajemen konteksnya berbeda dari ChatGPT versi web. Jika jailbreak biosafety berhasil di sini, berarti ada masalah pada batas keamanan deployment berbasis agen, area yang sangat diperhatikan OpenAI.
Kedua, pembatasan ini mengontrol variabel. Dengan permukaan uji yang tetap, laporan red team lebih mudah dibandingkan dan gangguan dari perbedaan prompt template antar kanal dapat dikurangi.
Namun batasan itu juga penting. Serangan pada ChatGPT versi web, aplikasi mobile, atau panggilan API langsung berada di luar cakupan bounty ini. Hadiah $25.000 membeli bukti tentang satu batas keamanan yang sangat spesifik, bukan bukti bahwa GPT-5.5 kuat di semua tempat.
Apa isi lima pertanyaan itu?
OpenAI tidak mengungkapkannya. NDA juga melarang peserta membocorkan soal.
Yang bisa diduga: lima pertanyaan itu kemungkinan dipilih oleh para ahli karena jawabannya dapat mempercepat riset biologi yang berbahaya. Anthropic selama setahun terakhir menjalankan pengujian serupa lewat Constitutional Classifiers, tetapi pendekatan OpenAI kali ini lebih agresif karena langsung menggabungkan red teaming dengan mekanisme bounty.
Bandingkan juga dengan Mythos Preview Anthropic sebelumnya, yang mengundang 40 perusahaan untuk mencari kerentanan. Bio Bounty OpenAI memakai undangan plus aplikasi, berfokus pada talenta red team murni, dan menguji satu kategori ekstrem: biosafety.
Dua pendekatan itu berbeda. Anthropic menguji ekosistem perusahaan, sedangkan OpenAI menekan batas sebuah skenario yang terisolasi.
Sinyal yang sebenarnya
Pertanyaannya bukan apakah $25.000 cukup untuk menarik red team kelas atas. Di pasar red team AI, angka itu sebenarnya tidak besar. Program VRP Google dan Bug Bounty Meta bisa mencapai enam digit.
Sinyal yang lebih penting adalah jendela pengujian selama tiga bulan.
Jika seseorang memenangkan hadiah dalam tiga bulan, berarti pagar biosafety GPT-5.5 memiliki kelemahan sistemik. OpenAI perlu menutupnya dalam pembaruan keamanan GPT-5.5 Pro berikutnya.
Jika tidak ada yang menang, OpenAI memperoleh catatan publik yang kredibel bahwa sebuah tantangan red team gagal menembus sistem. Itu lebih berguna daripada laporan keamanan yang hanya memuji diri sendiri.
Ini pertama kalinya OpenAI memakai mekanisme bounty untuk menguji secara terbuka satu kelas guardrail model. Bug bounty sebelumnya mencakup isu keamanan model dan privasi yang lebih luas. Kali ini arahnya dikunci pada biosafety.
Mereka yang mengikuti industri tahu alasannya. Keamanan biologi AI menjadi prioritas regulasi pada 2026. National Policy Framework Gedung Putih dan AI Act Uni Eropa sama-sama menempatkan risiko biologis sebagai kategori perhatian tertinggi.
OpenAI sedang mengumpulkan bukti sebelum detail regulasi benar-benar berlaku.
Tiga bulan ke depan akan menarik untuk disimak.
Sumber: GPT-5.5 Bio Bug Bounty (resmi OpenAI); CocoLoop; GPT-5.5 Bio Bug Bounty Program Aims to Improve AI Safety and Performance (GBHackers); OpenAI offers $25,000 reward to hack GPT-5.5 safety controls (VARindia)