SGLang percepat MiniMax-H3 1,95x tanpa kehilangan kualitas
LMSYS menguji MiniMax-H3 di 8x H200: jalur lossless SGLang 1,95x lebih cepat dari Diffusers, sementara tingkat agresif bisa sampai 6x dengan mengorbankan SSIM.
10 artikel terverifikasi tentang MiniMax, produk, dan perkembangan industri.
LMSYS menguji MiniMax-H3 di 8x H200: jalur lossless SGLang 1,95x lebih cepat dari Diffusers, sementara tingkat agresif bisa sampai 6x dengan mengorbankan SSIM.
MiniMax merilis platform kreasi Design berbasis model video H3. AI agent menyambung klip berdurasi 15 detik menjadi film hingga 3 menit, menyasar drama pendek dan video merek.
MiniMax H3 menggabungkan video 2K 15 detik, audio stereo native, harga RMB 0,8 per detik, dan rencana open weight.
MiniMax kembali himpun HK$16 miliar. Ringkasan lokal atas fakta terverifikasi dan sinyal industri di baliknya.
Zhipu dan MiniMax Hadapi Ujian Lock-Up Hong Kong. Artikel ini merangkum poin laporan, angka utama, penjelasan perusahaan, serta maknanya bagi pasar atau regulasi.
MiniMax merilis model open-weight M3 dengan konteks 1 juta token, kemampuan coding canggih, dan multimodalitas native, mengklaim sebagai yang pertama menggabungkan ketiganya.
MiniMax M2.7 menggunakan kerangka kerja agen untuk secara otomatis menjalankan lebih dari 100 putaran pelatihan tanpa campur tangan manusia, meningkatkan tolok ukur internal sebesar 30%. Model MoE jarang dengan 230B parameter ini hanya mengaktifkan 10B per inferensi dan kini bersifat open source.
MiniMax meluncurkan seri model penalaran M1, menargetkan o-series dari OpenAI dan R1 dari DeepSeek dengan performa kuat dalam penalaran matematika, pembuatan kode, dan analisis logika. M2.5 meraih skor 80,2% di SWE-bench Verified.
MiniMax, perusahaan yang relatif rendah hati di kancah AI China, telah membangun reputasi kuat untuk kemampuan pembuatan video Hailuo AI-nya, yang bersaing dengan alat domestik teratas dan versi awal Sora dalam hal kualitas.
MiniMax-01, yang dirilis tahun lalu, menampilkan Lightning Attention, varian atensi linier yang menurunkan kompleksitas komputasi dari O(n²) menjadi mendekati O(n), memberikan peningkatan kecepatan beberapa kali lipat dalam skenario konteks panjang sambil mempertahankan akurasi yang kompetitif.