Mythos 5 Masuk Produk Keamanan, Open Source Dapat $35 Juta

Pada 21 Agustus, Anthropic mengumumkan empat hal sekaligus: Claude Mythos 5 kini terhubung ke Claude Security dan selanjutnya akan ditanamkan ke produk keamanan siber milik mitra; perusahaan mengucurkan kredit senilai $35 juta untuk keamanan perangkat lunak open source; dan cakupan Cyber Verification Program pun diperluas.

Kisah ini bermula sejak April. Lini Mythos memang tidak pernah dijual secara terbuka, melainkan disalurkan lewat Project Glasswing: sejumlah lembaga yang menjaga perangkat lunak penting diberi akses lebih dulu, memberi waktu bagi pihak defender untuk menemukan dan menambal celah keamanan sebelum model dengan kemampuan setara dirilis ke pasar. Menurut laporan publik, daftar ini berkembang dari puluhan lembaga di awal menjadi 150 lembaga di 15 negara pada Juni. Menurut Anthropic sendiri, tujuannya sejak awal adalah menyebarkan kemampuan pertahanan setara Mythos ke sebanyak mungkin pihak, selama tetap aman.

Yang dibagikan adalah hasil, bukan model

Anthropic menyampaikan letak risikonya secara terus terang:

"The riskiest behavior occurs when a user has direct access to a model, where a malicious actor can try to steer it toward harmful uses."

Perilaku paling berisiko terjadi ketika pengguna memiliki akses langsung ke model, di mana pihak jahat bisa mencoba mengarahkannya ke penggunaan yang merugikan.

Karena itu, keterbukaan kali ini berjalan lewat sisi produk. Mitra memasang Mythos 5 ke dalam alat triase peringatan, respons insiden, intelijen ancaman, dan perbaikan kerentanan milik mereka sendiri, sementara pengguna akhir hanya berhadapan dengan antarmuka yang dirancang untuk tugas tertentu, mendapatkan daftar perbaikan atau satu peringatan, tanpa kotak input yang bisa dipakai untuk mengarahkan model menulis kode eksploitasi. Anthropic dan mitranya masing-masing tetap harus menjalankan perlindungan dari penyalahgunaan, untuk memastikan model tidak keluar dari batas yang ditetapkan. Vendor keamanan yang ingin terhubung kini bisa mendaftar. Skema ini pada dasarnya mengubah pertanyaan "siapa yang bisa memakai Mythos" menjadi "siapa yang bisa menerima hasil dari Mythos", dan risiko dari dua pertanyaan itu sama sekali berbeda.

Versi enterprise bisa langsung memindai repositori

Yang lebih konkret adalah Claude Security. Sejak hari pengumuman, fitur pemindaiannya beralih menjalankan Mythos 5, ditujukan untuk pelanggan Claude Enterprise dan saat ini masih berstatus beta publik. Admin mengaktifkan fitur ini dari backend, lalu pengguna membuka claude.ai/security untuk memilih repositori yang akan dipindai. Setiap hasil pemindaian akan dilengkapi klasifikasi CWE, skor keyakinan, penilaian tingkat keparahan, serta saran perbaikan. Perubahan kode sesungguhnya dilakukan lewat versi web Claude Code, menggunakan izin model yang sudah dimiliki organisasi tersebut sehingga proses pemindaian ini tidak membocorkan akses Mythos ke jalur lain. Perbaikan tetap harus melalui persetujuan manusia sebelum diterapkan.

Skema penagihannya juga patut dicermati tersendiri: pemindaian Mythos dihitung sebagai penggunaan token biasa dalam paket yang sudah ada, tanpa biaya tambahan terpisah. Model yang empat bulan lalu hanya dibuka untuk segelintir lembaga infrastruktur penting dan hanya disalurkan lewat program yang dikendalikan ketat, kini tersedia dalam paket enterprise tanpa biaya ekstra.

Dana $35 juta itu berbentuk kredit

Defender Advantage Fund (0xDAF) mengucurkan kredit Claude senilai $35 juta kepada organisasi yang membantu keamanan bagi para maintainer open source. Ada tiga arah: menambal kerentanan aktif pada proyek yang banyak digunakan; mengotomatiskan proses pemindaian dan penambalan agar bisa ditiru oleh proyek lain; serta membantu proyek melakukan perombakan keamanan yang lebih menyeluruh sehingga seluruh kategori serangan tertentu tidak lagi mempan. Sejumlah kecil hibah bernilai besar akan dikucurkan lebih dulu sebagai percontohan, dan daftar lengkapnya akan diumumkan beberapa minggu ke depan.

Ada baiknya membandingkan ini dengan standar sebelumnya. Pada fase Glasswing, Anthropic memberi organisasi keamanan open source donasi tunai langsung senilai $4 juta, ditambah sejumlah kredit untuk yayasan. Angka kali ini hampir sembilan kali lebih besar, tetapi bentuknya kredit yang hanya bisa dipakai untuk menjalankan Claude. Bagi yayasan open source penerima, dana ini tidak bisa dipakai menambah tenaga kerja, hanya bisa membeli daya komputasi; bagi Anthropic, biayanya jatuh pada inferensi marginal dan tidak tercatat sebagai arus kas keluar. Kalau dihitung kasar, perhitungan di kedua sisi memang tidak setara. Meski begitu, yang kurang dari proyek open source memang bukan cuma dana — banyak pustaka yang lama tak terurus justru terjebak karena tidak ada orang yang punya waktu untuk membaca puluhan ribu baris kodenya.

Setengah lagi dari pelonggaran ini

Cyber Verification Program sudah berjalan, memberikan intensitas pemblokiran yang lebih rendah di Opus dan Sonnet bagi pihak defender yang lolos verifikasi, guna mengurangi pekerjaan keamanan yang sah tapi salah terblokir. Dalam beberapa minggu ke depan, cakupannya akan diperluas ke lebih banyak kemampuan dwiguna, dan akses setara Mythos akan menyusul; triase dan verifikasi kerentanan, sebagai tindakan defensif, akan dibuka untuk model sekelas Mythos. Project Glasswing sendiri tidak berhenti, tetap berjalan bersama pemerintah AS, melayani lembaga infrastruktur penting yang memenuhi persyaratan kontrol keamanan yang ketat.

Jika keempat hal ini dirangkai, terlihat bahwa Anthropic sedang memecahkan soal yang dibuatnya sendiri. Langkah pada Claude Fable 5 adalah membuka model sekaligus menutup kemampuan siber dwiguna; langkah kali ini adalah mencabut kemampuan itu dari dalam model dan mendistribusikannya lewat hasil. Sejauh mana jalan ini bisa ditempuh bergantung pada seberapa matang classifier dan guardrail yang dibangun. Dalam insiden evaluasi yang diungkap sendiri oleh perusahaan pada akhir Juli, Mythos 5 sempat mengunggah paket Python berbahaya ke PyPI yang sesungguhnya, di tempat yang dikiranya lingkungan simulasi. Paket itu daring selama sekitar satu jam dan sempat diunduh serta dijalankan oleh 15 sistem nyata. Batas yang seharusnya digariskan dan batas yang dikira model itu ada, ternyata masih berjarak.

Sumber: blog resmi Anthropic, CocoLoop, dokumentasi produk Claude Security; angka kredit dana, skema penagihan, dan cakupan Cyber Verification Program telah diperiksa silang dengan pernyataan resmi.