NVIDIA buka sumber seluruh keluarga Nemotron 3 dan data pelatihan

Huang ingin menancapkan bendera di pasar model terbuka

Banyak yang mengira NVIDIA hanya menjual GPU, namun perusahaan diam-diam merilis seluruh seri Nemotron 3 — bukan hanya bobot model, tetapi juga dataset pra-pelatihan 3 triliun token, alur kerja pembelajaran penguatan, dan alat evaluasi, semuanya dibuka sumbernya.

Sinyal dari langkah ini jelas: NVIDIA tidak ingin hanya menjadi penjual sekop, ia ingin mengambil tempat di ekosistem AI terbuka.

Tiga ukuran, semuanya arsitektur MoE

Seri Nemotron 3 menggunakan arsitektur Hybrid Latent MoE, tersedia dalam tiga versi:

ModelTotal parameterParameter aktif per inferensiStatus
Nano30 miliar~3 miliarDirilis
Super~100 miliar~10 miliarParuh pertama 2026
Ultra~500 miliar~50 miliarParuh pertama 2026

Keunggulan utama MoE adalah meskipun total parameter besar, hanya sebagian kecil yang diaktifkan per inferensi, sehingga biaya komputasi aktual dapat dikendalikan. DeepSeek V3 dan Llama 4 menggunakan pendekatan yang sama, dan kini NVIDIA mengikutinya.

Hasil benchmark Nano cukup menarik

Untuk versi Nano yang telah dirilis, data resmi menunjukkan:

  • Kecepatan inferensi 4 kali lipat dari generasi sebelumnya
  • Pengurangan generasi token inferensi sebesar 60% (lebih sedikit langkah antara untuk mencapai kesimpulan)
  • Jendela konteks 1M token

Lembaga evaluasi pihak ketiga Artificial Analysis berkomentar: "Model paling terbuka dan efisien di kelas ukurannya, dengan akurasi terdepan."

Arah "inferensi efisien" ini agak mirip dengan pendekatan sparse attention DeepSeek V3.2 — keduanya bertujuan mengurangi komputasi tanpa mengorbankan kualitas.

Toolchain yang sepenuhnya terbuka

NVIDIA secara bersamaan membuka sumber seperangkat alat pendukung:

  • NeMo Gym: Kerangka kerja pelatihan pembelajaran penguatan agen
  • NeMo RL: Pustaka alur kerja pembelajaran penguatan
  • NeMo Evaluator: Alat evaluasi

Bobot model, data pelatihan, dan toolchain semuanya tersedia di Hugging Face dan GitHub di bawah lisensi yang sepenuhnya terbuka. Siapa pun dapat mengunduh, menyetel halus, dan menyebarkannya.

Mengapa NVIDIA melakukan ini

Beberapa kemungkinan logika:

Perangkat lunak mengunci perangkat keras. Jika Anda menggunakan toolchain model terbuka NVIDIA, kemungkinan besar Anda akan menjalankannya di GPU NVIDIA. Ini mirip dengan strategi CUDA — menggunakan ekosistem untuk mengunci infrastruktur komputasi.

Melindungi diri dari tekanan kompetisi sumber terbuka. Model terbuka seperti DeepSeek, Llama 4, dan Qwen semakin kuat. Jika NVIDIA hanya bermain di lapisan perangkat keras, pengaruhnya dalam ekosistem AI akan terkikis. Membangun model terbuka berarti masuk langsung ke arena.

Bundling pengadaan perusahaan. Banyak perusahaan besar membeli paket GPU-plus-layanan NVIDIA. Memiliki model terbuka tepercaya yang terintegrasi adalah nilai jual dan bagian dari materi penjualan.

Tentu saja, membuka sumber juga merupakan biaya bagi NVIDIA. Namun mengingat kekuatan finansial perusahaan saat ini, itu bukan masalah.

Super dan Ultra layak ditunggu

Nano yang dirilis saat ini relatif konservatif dalam skala. Yang benar-benar menarik adalah Super (100 miliar parameter) dan Ultra (500 miliar parameter) yang dijadwalkan pada paruh pertama 2026. Jika Nemotron 3 Ultra menghasilkan benchmark yang cukup baik, ini akan lebih dari sekadar "NVIDIA juga membuat model" — ini akan menjadi pemain yang benar-benar kompetitif di papan peringkat model terbuka.

Sumber referensi: CocoLoop, NVIDIA Debuts Nemotron 3 Family of Open Models (NVIDIA Newsroom)