Departemen Keuangan AS Panggil Wall Street untuk Evaluasi Mythos dari Anthropic

AI yang Menemukan Kerentanan dengan Sendirinya

Mari kita mulai dengan angka. Saat menguji Mythos Preview, Anthropic menemukan bahwa model tersebut berhasil mereproduksi dan mengeksploitasi kerentanan dalam satu percobaan sebanyak 83,1% dari kasus. Sebagai perbandingan, Claude Opus 4.6 dari perusahaan yang sama mendekati 0% pada metrik yang sama.

Ini bukan sekadar peningkatan kecil — ini lompatan dari 0% ke 83%.

Apa yang bisa dilakukannya secara konkret? Mythos menulis eksploitasi peramban yang merangkai empat kerentanan terpisah, menggunakan teknik JIT spray yang kompleks, dan berhasil melarikan diri dari proses renderer dan sandbox sistem operasi. Mythos juga menulis program eksekusi kode jarak jauh yang mengeksploitasi kerentanan server FreeBSD NFS menggunakan teknik ROP chain.

Anthropic sendiri mengatakan model tersebut menemukan ribuan kerentanan zero-day baru di setiap sistem operasi utama dan setiap peramban utama.

Laporan sebelumnya tentang Mythos yang menemukan kerentanan berusia 27 tahun kini tampaknya hanya puncak gunung es.

Ketua Fed, Menteri Keuangan, dan Enam CEO Bank dalam Satu Ruangan

Ketika Anthropic merilis pratinjau Mythos pada 7 April, akses dibatasi pada sekitar 40 organisasi dalam program bernama "Project Glasswing." Pesertanya meliputi Amazon, Apple, Microsoft, Google, Cisco, CrowdStrike, JPMorgan Chase, NVIDIA, Broadcom, Palo Alto Networks, dan Linux Foundation. Setiap organisasi peserta juga menerima sumber daya komputasi hingga US$100 juta.

Kemudian, pada 10 April, Ketua Federal Reserve Jerome Powell dan Menteri Keuangan Scott Bessent memanggil CEO Goldman Sachs, Wells Fargo, Morgan Stanley, Bank of America, dan Citigroup ke dalam satu ruangan untuk rapat darurat.

Agendanya: Bagaimana jika AI Anthropic jatuh ke tangan yang salah?

CTO CrowdStrike menyatakannya dengan tegas: "Jendela waktu dari penemuan kerentanan hingga eksploitasi telah menyusut dari berbulan-bulan menjadi hitungan menit. AI telah mengubah kecepatan proses ini secara fundamental."

Tapi Pentagon Masih Melarang Anthropic

Inilah kontradiksi utamanya.

Sementara Powell dan Bessent mengumpulkan para bankir di Washington untuk mengevaluasi Mythos, Pentagon masih menempatkan Anthropic dalam daftar hitam rantai pasokannya, mewajibkan departemen pertahanan untuk berhenti menggunakan semua platform Anthropic.

Alasan Presiden Trump dan Menteri Pertahanan Pete Hegseth: Anthropic bersikeras membatasi penggunaan AI-nya dalam skenario militer.

Kesimpulannya: Gedung Putih di satu sisi membiarkan Wall Street menguji pertahanan, sementara di sisi lain melarang militer menggunakan perusahaan yang sama. Perusahaan yang sama, model yang sama, pemerintahan yang sama — dua sikap yang sepenuhnya berlawanan.

Mantan penasihat AI Gedung Putih David Sacks mengatakan ia mempertanyakan apakah Anthropic menggunakan kecemasan keamanan untuk memasarkan produknya dan memengaruhi kebijakan regulasi. Kritik ini memiliki beberapa dasar.

Penjelasan Anthropic

Logika Anthropic adalah: Justru karena model ini sangat berbahaya, mereka enggan melepaskannya secara luas. Filosofi desain Project Glasswing adalah membiarkan perusahaan teknologi terkemuka menggunakan Mythos untuk menemukan kerentanan di sistem mereka sendiri dan menambalnya sebelum penyerang dapat menyerang.

  • Mythos menemukan kerentanan → Organisasi peserta menambalnya → Pihak bertahan unggul
  • Peserta berbagi intelijen keamanan
  • Anthropic melaporkan semua kerentanan yang ditemukan ke vendor terkait

Ini disebut "AI melawan AI." Masalahnya: Tidak semua orang percaya Anthropic dapat mengontrol batas akses. Ke-40 organisasi peserta termasuk pesaing komersial, dan berbagi informasi kerentanan adalah permainan strategi yang kompleks.

Dan angka "ribuan" belum dirinci secara detail.

Apa Artinya Ini

Kisah Mythos lebih penting daripada skor tolok ukur mana pun karena menyentuh saraf nyata: Jika AI dapat secara otomatis menemukan kerentanan di sistem mana pun, logika dasar keamanan siber perlu ditulis ulang.

Powell dan Bessent tidak memanggil CEO bank ke rapat darurat untuk membahas apakah AI memiliki potensi. Mereka melakukannya karena mereka percaya ancaman itu nyata dan akan segera terjadi.

Dan rapat darurat itu sendiri adalah bukti paling kuat tentang seberapa canggih AI ini.

Terlepas dari apakah kritik Sacks valid atau tidak, sebuah model AI memaksa Ketua Fed duduk bersama CEO bank-bank besar Wall Street untuk pengarahan keamanan — ini adalah yang pertama dalam sejarah manusia.

Sumber: Trump officials may be encouraging banks to test Anthropic's Mythos model (TechCrunch); Anthropic Mythos model can find and exploit 0-days (The Register); Powell, Bessent Warn Banks About Security Risks From Anthropic's Mythos AI (Bloomberg/Yahoo Finance); CocoLoop, After Anthropic's Mythos AI uncovers thousands of zero-day bugs, top US officials huddle with bank CEOs (TechXplore); Anthropic withholds Mythos Preview model because its hacking is too powerful (Axios).