DeepSeek V4 Pro bergerak dari status preview menuju bentuk API yang lebih jelas. Pada 13 Agustus, halaman harga DeepSeek menampilkan deepseek-v4-pro sebagai DeepSeek-V4-Pro-0813, dengan endpoint OpenAI-compatible dan Anthropic-compatible yang tetap tersedia.
Tabel yang sama mencantumkan konteks 1M token, output maksimum 384K token, dukungan JSON Output, Tool Calls, Responses API, dan Anthropic API. Batas konkurensi Pro adalah 500, jauh di bawah Flash yang mencapai 2500.
Output panjang berarti biaya panjang
“We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.”
Peringatan resmi ini membuat rilis tersebut lebih penting bagi tim engineering. Output 384K berguna untuk analisis repositori besar, review dokumen, rencana migrasi, dan alur kerja agent, tetapi biaya akan naik saat generasi output membesar.
Pro tiga kali lebih mahal dari Flash
Di tabel harga berbahasa Tionghoa, V4 Pro dikenakan RMB 0,025 per 1M token input cache-hit, RMB 3 untuk input cache-miss, dan RMB 6 untuk output. V4 Flash masing-masing RMB 0,02, RMB 1, dan RMB 2. Jadi input cache-miss dan output Pro tiga kali harga Flash.
Hugging Face dan OpenRouter sama-sama menggambarkan V4 Pro sebagai model MoE dengan 1,6T parameter total, 49B parameter aktif, dan konteks 1M token. Ini adalah tier kelas berat, bukan pilihan default untuk chat singkat atau ekstraksi sederhana.
Hal berikutnya yang perlu diuji adalah laporan khusus V4 Pro-0813, benchmark pihak ketiga yang memisahkannya dari Preview dan Flash 0731, serta apakah DeepSeek tetap murah untuk konteks panjang setelah kenaikan harga.
Sumber: dokumentasi model dan harga DeepSeek API, changelog DeepSeek API, Chao News, kartu model Hugging Face DeepSeek-V4-Pro, CocoLoop, OpenRouter; memverifikasi versi DeepSeek-V4-Pro-0813, konteks 1M, output maksimum 384K, cakupan harga RMB dan USD, batas konkurensi, harga pembanding V4 Flash, 1,6T parameter total dan 49B parameter aktif.