DeepSeek V3.2 adopte l'attention sparse et réduit de moitié les coûts d'inférence
DeepSeek a publié V3.2 avec une nouvelle architecture d'attention sparse qui réduit la complexité de O(L²) à O(Lk) et réduit considérablement les coûts d'inférence, avec un prix d'entrée de seulement 0,28 $/M token, tout en maintenant des performances globales similaires à la version précédente.