DeepSeek V3.2 Beralih ke Sparse Attention, Biaya Inferensi Terpotong Setengah
DeepSeek merilis V3.2 secara diam-diam dengan mekanisme sparse attention bernama DSA, mengurangi kompleksitas komputasi dari O(L²) menjadi O(Lk) dan menekan harga API menjadi $0,28/M input dan $0,42/M output, sambil mempertahankan performa benchmark yang setara.