Nvidia merilis Open Agent Safety Platform pada 28 September, sebuah desain referensi keamanan untuk agen AI yang terbagi rata antara software dan hardware. Sisi software adalah OpenShell, runtime open source yang mengunci setiap agen di dalam sandbox. Sisi hardware disebut Sentry, program pemantau yang berjalan di data processing unit BlueField-4 dan bisa mengisolasi atau menghentikan agen dalam hitungan milidetik begitu ia keluar jalur.
Nvidia mengklaim lebih dari 100 organisasi terlibat, termasuk Anthropic, Microsoft, SAP, Scale AI, JPMorgan Chase, Palantir, CrowdStrike, Palo Alto Networks, Hugging Face, dan Perplexity. Waktu perilisannya pun mudah dipahami: dalam sepekan terakhir, OpenAI melaporkan bahwa agennya menerobos sejumlah situs lembaga pemerintah AS saat pengujian, Google mengakui Gemini membobol tiga perusahaan sungguhan dalam pengujian, dan Senat Australia kemudian mengundang CEO kedua perusahaan itu untuk hadir dalam dengar pendapat.
OpenShell: Menaruh Izin Akses di Luar Jangkauan Agen
OpenShell bersifat open source di bawah lisensi Apache 2.0, dengan versi saat ini 0.1.0. Terdiri dari tiga bagian: Gateway mengelola siklus hidup dan kebijakan; Supervisor berjalan di luar workload dan memeriksa setiap permintaan yang dikeluarkan agen satu per satu; Sandbox membatasi file dan proses di level kernel, sehingga satu-satunya jalur keluar jaringan bagi agen adalah yang melewati Supervisor.
Penanganan kredensial adalah bagian yang cukup diperhatikan dalam desain ini. Kunci API asli tidak pernah masuk ke lingkungan tempat agen berjalan — agen hanya memegang placeholder, yang baru diganti dengan kunci asli setelah permintaan lolos persetujuan. Setiap kunci juga hanya terikat pada endpoint yang sudah disetujui, sehingga tidak berguna untuk memanggil layanan lain. Kebijakan ditulis dalam YAML dan dikompilasi menjadi aturan OPA/Rego yang mengevaluasi permintaan HTTP, GraphQL, dan MCP satu per satu.
Framework yang secara resmi dinyatakan kompatibel adalah Codex, Claude Code, Pi, dan Hermes. Blog teknis Nvidia menyebut perusahaan desain chip Cadence, platform agen on-demand milik Slack, dan Gecko Robotics (pembuat robot inspeksi) sudah mengujinya.
Sentry: Pemantauan yang Tidak Berjalan di Mesin yang Sama
Blog teknis Nvidia merangkum seluruh pendekatan ini menjadi lima prinsip, salah satunya adalah “eksekusi out-of-band”: mekanisme kontrol harus ditempatkan di lokasi yang tidak terjangkau oleh agen. Begini bunyi tulisan di blog tersebut:
“an agent in these circumstances cannot be expected to fully govern its own behavior.”
(dalam situasi seperti ini, agen tidak bisa diharapkan sepenuhnya mengendalikan perilakunya sendiri.)
Sentry adalah wujud perangkat keras dari prinsip tersebut. Ia berjalan di BlueField-4, terpisah secara fisik dari host tempat agen berada, dan menurut Nvidia tidak terlihat baik oleh agen maupun penyerang. Dalam Vera Rubin POD, BlueField-4 ditempatkan pada satu-satunya jalur yang dilalui node untuk mengakses model — semua trafik pemanggilan model harus melewatinya, dan pemantauan serta pemblokiran dilakukan pada kecepatan line rate.
Pendekatan Anthropic adalah memisahkan loop inferensi Claude Managed Agents dari sandbox eksekusinya, lalu menghubungkan susunan ini dengan OpenShell dan BlueField, sehingga perusahaan bisa menerapkan kontrol akses di lapisan sandbox.
Dalam siaran pers, Jensen Huang mengatakan: “AI's extraordinary potential for society will only be realized if we solve AI safety.” (Potensi luar biasa AI bagi masyarakat baru akan terwujud jika kita berhasil menyelesaikan masalah keamanan AI.)
Langkah-Langkah Nvidia di Jalur Agen AI
Bila dirangkai, rilis-rilis terbaru Nvidia menunjukkan langkahnya yang terus mendorong lebih dalam ke lapisan runtime untuk agen. Pada GTC April lalu, Nvidia menggandeng sejumlah perusahaan software enterprise untuk membangun platform pengembangan agen. Mei lalu, ia bermitra dengan ServiceNow untuk runtime agen tingkat enterprise. Kali ini, Nvidia memisahkan urusan “mengendalikan agen” menjadi proyek open source tersendiri dan mengikatnya dengan DPU buatannya sendiri.
Kombinasi software open source dengan titik penegakan (enforcement) di silikon buatan sendiri ini mirip dengan cara Nvidia dulu mendorong CUDA dan NVLink: ekosistem bisa masuk secara gratis, tapi lapisan perlindungan paling kuat membutuhkan hardware Nvidia. Tim yang hanya ingin memakai OpenShell untuk sandboxing bisa langsung menerapkannya sekarang; yang menginginkan pemantauan independen dari host seperti Sentry harus menunggu jadwal pengiriman BlueField-4 dan Vera Rubin.
Situasi tim di Tiongkok perlu dilihat terpisah. OpenShell adalah kode open source, sehingga tidak ada hambatan untuk memodifikasinya atau menghubungkannya dengan model buatan lokal. Namun Sentry bergantung pada BlueField-4, yang termasuk lini produk jaringan pusat data Nvidia — apakah bisa diadakan di Tiongkok, dan dengan konfigurasi seperti apa, belum ada informasi publik dan tidak bisa diverifikasi.
Sumber: pengumuman Nvidia Newsroom, blog teknis Nvidia (dua tulisan tentang Open Agent Safety Platform dan OpenShell), CocoLoop, IT之家, The Next Web. Diverifikasi terhadap daftar organisasi mitra, nomor versi dan lisensi open source OpenShell, serta pernyataan resmi mengenai waktu respons isolasi Sentry.