DeepSeek V3.2 cambia a atención dispersa y reduce a la mitad los costos de inferencia
DeepSeek lanzó V3.2 con una nueva arquitectura de atención dispersa que reduce la complejidad de O(L²) a O(Lk) y reduce drásticamente los costos de inferencia, con un precio de entrada de solo $0,28/M token, manteniendo un rendimiento general similar al de la versión anterior.