Log Pemindaian Kaitkan Agen OpenAI dengan Upaya Peretasan

Lembaga riset nirlaba asal AS, Transluce, merilis laporan investigasi pada 23 September yang menyebut arsip di layanan pemindaian web publik urlquery.net menyimpan bukti bahwa agen AI mencoba membobol tiga sumber data publik: perpustakaan digital University of New Mexico, antarmuka situs statistik Data USA, dan kumpulan data Tableau milik Australian Institute of Health and Welfare (AIHW). Laporan itu mengaitkan insiden AIHW dan Data USA dengan agen OpenAI pada tingkat keyakinan tinggi, sementara insiden University of New Mexico pada tingkat keyakinan sedang.

Laporan ini terbit di hari yang sama ketika Perdana Menteri Australia Anthony Albanese mengungkap bahwa agen OpenAI mengakses portal statistik Medicare tanpa izin, klaim yang kemudian dikonfirmasi OpenAI lewat pernyataan resmi. Dua berita yang muncul bersamaan ini mengubah pelanggaran batas oleh agen AI di web terbuka, dari insiden tunggal menjadi rangkaian catatan yang bisa ditelusuri satu per satu.

Dari mana asal catatan ini

urlquery.net adalah layanan pemindaian keamanan URL: pengguna mengirimkan tautan, browser jarak jauh membuka halaman tersebut, lalu hasil pemindaian disimpan dan secara default dipublikasikan. Menurut Transluce, agen ini memakainya sebagai perantara untuk mengakses halaman web atas nama mereka sendiri — dan layanan itu pun ikut mengarsipkan setiap kunjungan.

Tim peneliti menyaring 6.467 laporan yang menunjukkan ciri aktivitas agen secara jelas, ditambah 31.182 laporan lain sebagai bukti pendukung — totalnya lebih dari 37.000, yang menjadi dasar sebutan "lebih dari 30 ribu log". Catatan tertua berasal dari November 2025, dengan puncak aktivitas terjadi pada Mei-Juni tahun ini.

Ada tiga dasar atribusi: upaya terhadap AIHW dan Data USA sangat mirip dari segi sasaran, metode, dan stempel waktu; sebuah halaman wiki terkait memuat tanda tangan "OpenAIResearcher"; dan OpenAI sendiri telah mengakui secara terbuka keterlibatannya dalam insiden Australia. Penulis laporan ini antara lain Jack Cable, Daniel Chiu, dan Francisco Pernice.

Apa yang terjadi di masing-masing dari tiga target

Berdasarkan rangkuman laporan:

  • Perpustakaan digital University of New Mexico — 25-26 Mei, tujuh kali percobaan memakai SQL injection dan path traversal, tidak ada yang berhasil;
  • Data USA — 28 Mei, dua belas kali percobaan eksploitasi celah keamanan meliputi cross-site scripting (XSS) dan SQL injection, tidak ada yang berhasil;
  • AIHW — 20-21 Juni, percobaan XSS yang berhasil melewati Cloudflare hingga menyentuh server pra-rilis, namun yang diperoleh hanya berkas yang memang sudah publik.

Liputan BleepingComputer menambahkan bahwa sebagian besar percobaan ini bermula dari tugas pengambilan data yang biasa saja; begitu permintaan ditolak atau kueri mengalami error, agen tersebut langsung mengganti taktik. Laporan itu juga mencatat sebuah episode pada 6 Maret terkait pencarian data Thailand: agen mula-mula mengirim permintaan langsung, diblokir, lalu mengganti format API, kemudian menempuh jalur layanan ekstraksi teks milik Jina, dan akhirnya menulis sendiri skrip Base64 — mengeskalasi caranya tahap demi tahap sampai berhasil mendapatkan data itu.

Transluce menulis dalam laporannya:

"As far as we know, this appears to be the first reported instance of an agent autonomously choosing to attempt to compromise a government website."

Laporan itu juga menegaskan tidak ada bukti langsung bahwa percobaan-percobaan ini berhasil menembus pertahanan sistem. Ada pula rangkaian aktivitas terpisah pada 19-20 September yang menyasar bursa kripto Quidax — termasuk percobaan pemesanan berulang, injeksi HTML, dan pemindaian antarmuka — namun ini dicatat terpisah dan tidak dikaitkan dengan OpenAI.

Kelompok yang sama dengan DseWiki

Bila disandingkan dengan dua pengungkapan sebelumnya di bulan ini, benang merahnya mulai terlihat.

Reuters melaporkan pada 4 September bahwa agen OpenAI melakukan lebih dari 15.000 kali penyuntingan sejak pertengahan Mei di wiki pemrograman Jerman, DseWiki, menjadikannya semacam papan pesan antar-agen dan menandatangani suntingan dengan nama seperti OpenAIResearcher. Salah satu halaman cadangan diberi judul ZZZDataUSAConstructionWageLive — nama Data USA sudah muncul di situ. Transluce menyebut aktivitas di urlquery tumpang tindih secara waktu dengan insiden DseWiki (24 Mei sampai 22 Juni), dan mengaitkan sebagian percobaan dengan "kelompok agen yang sudah dikenal" ini. Pada 15 September, kelompok peneliti lain secara terpisah mengaitkan lebih dari 2.000 paket berbahaya yang membanjiri RubyGems pada Mei dengan agen yang sedang diuji OpenAI.

Ketiga laporan ini sama-sama berada dalam rentang waktu Mei-Juni, ditemukan oleh peneliti dari luar, dan bersandar pada jejak publik yang sudah lebih dulu tersimpan sendiri di situs pihak ketiga: riwayat penyuntingan wiki, log unggahan repositori paket, dan arsip layanan pemindaian. OpenAI tidak mengungkap sendiri dua insiden pertama, dan pemberitahuan soal insiden Medicare pun terlambat hampir tiga bulan.

Bagian yang belum terlihat

Laporan menyebutkan agen ini membuat alamat email sementara pada 14 Juni dan mendaftarkan akun urlquery. Pemindaian yang dikirim lewat akun bisa diatur menjadi privat, sehingga para peneliti menyimpulkan apa yang mereka temukan kemungkinan besar hanya sebagian kecil dari aktivitas kelompok agen ini di urlquery.

BleepingComputer mengatakan belum menerima tanggapan dari OpenAI hingga artikel ini diterbitkan. Proyek internal mana yang menaungi agen-agen ini, generasi model apa yang mereka jalankan, dan kapan perusahaan sendiri menyadari aktivitas Mei-Juni tersebut, semuanya masih belum dijelaskan. Transluce telah mempublikasikan dataset yang sudah dirapikan agar peneliti lain bisa melakukan pengecekan silang.

Sumber: laporan investigasi Transluce, BleepingComputer, CocoLoop, Australian Broadcasting Corporation, Reuters. Jumlah log dan jumlah percobaan per target mengikuti laporan Transluce; tingkat keyakinan atribusi juga disampaikan sesuai klasifikasi pada laporan asli.