DeepSeek membuka pratinjau versi antara dari DeepSeek V4.1 Flash. Menurut deskripsi resminya, model ini memakai arsitektur baru dengan dukungan multimodal native, kemampuan lebih kuat, kecepatan lebih tinggi, dan biaya lebih rendah.
Hambatan untuk mengaksesnya nyaris tidak ada: base_url tetap sama, cukup ganti nama model menjadi deepseek-v4.1-flash-expires-on-0910 untuk memanggilnya. Tarifnya sama dengan deepseek-v4-flash, dengan batas 20 permintaan bersamaan per akun. Angka "0910" dalam nama tersebut menandai masa berlakunya — setelah 10 September, ID model ini tidak akan berfungsi lagi.
Multimodal native adalah inti dari perubahan ini
Sebelumnya, untuk memproses input campuran gambar dan teks di seri Flash dibutuhkan paket ekstensi visual terpisah. Versi ini menanamkan kemampuan tersebut langsung ke dalam model itu sendiri.
Bedanya bukan sekadar satu paket lebih sedikit yang perlu dipasang. Pendekatan paket ekstensi biasanya memproses gambar lewat encoder terpisah terlebih dahulu baru kemudian menyambungkannya ke urutan teks — proses konversi di tengah itu memakan latensi sekaligus akurasi. Multimodal native berarti gambar dan teks dilatih serta diinferensikan dalam satu arsitektur yang sama. Bagi lini produk Flash yang mengandalkan latensi rendah, ini adalah pergeseran arah: yang dikejar bukan batas atas pemahaman visual yang lebih tinggi, melainkan tidak membayar latensi ekstra demi kemampuan multimodal.
Dari segi posisinya, V4.1 Flash berada di antara V4 Flash dan V4 Pro yang sudah ada: arsitektur diperbarui, dilengkapi multimodal native, sambil tetap mempertahankan karakter latensi rendah khas seri Flash.
Menuliskan tanggal kedaluwarsa langsung di nama model
Skema penamaan seperti ini bukan hal baru, tetapi digunakan pada sebuah "versi antara" membuatnya membawa lebih banyak informasi dibanding pengumuman itu sendiri.
ID model yang menyertakan tanggal kedaluwarsa berarti siapa pun yang mengintegrasikannya harus menyelesaikan evaluasi dalam dua hari dan tahu kapan harus mencabutnya. Ini praktis menyingkirkan kemungkinan penggunaan di lingkungan produksi, menyisakan satu tujuan utama: mengumpulkan data performa arsitektur baru ini di bawah trafik nyata. Jendela 48 jam dan batas 20 permintaan bersamaan per akun menempatkannya sebagai uji beban, bukan sebagai peluncuran resmi.
Bagi pengembang di Tiongkok, penilaian yang bisa dilakukan sebenarnya terbatas. Skala parameter, perubahan panjang konteks, dan data evaluasi semuanya belum diungkapkan secara resmi, dan belum ada kejelasan soal jadwal rilis resmi V4.1 maupun apakah arsitektur baru ini akan diterapkan juga ke tingkat Pro. Klaim "lebih cepat dan lebih hemat" untuk saat ini hanya berasal dari satu pihak, yaitu vendornya sendiri, dan tidak bisa diverifikasi dari luar. Satu hal yang bisa diverifikasi sendiri hanyalah bahwa harganya tidak berubah: dengan biaya yang sama, bisa dijalankan selama dua hari.
Ada baiknya membandingkan ini dengan ritme lini produk ini di masa lalu. Perjalanan V4-Flash dari pratinjau ke rilis API resmi, harga promosi V4-Pro yang dimasukkan ke daftar harga permanen, serta penambahan tarif dua kali lipat untuk jam sibuk pada API — semuanya rampung dalam hitungan beberapa bulan. DeepSeek selama ini jarang memberi pengumuman jauh-jauh hari untuk pergantian versi, dan kali ini bahkan jadwal versi resminya pun tidak disebutkan.
Sumber: pengumuman DeepSeek Open Platform, IT Home, CocoLoop, The Paper (澎湃新聞); ID model, dasar penagihan, dan batas konkurensi mengikuti keterangan pratinjau resmi, sementara skala parameter dan data evaluasi belum diungkapkan secara resmi.