DeepSeek V3.2 adota atenção esparsa e reduz custos de inferência pela metade
DeepSeek lançou o V3.2 com uma nova arquitetura de atenção esparsa que reduz a complexidade de O(L²) para O(Lk) e corta drasticamente os custos de inferência, com preço de entrada de apenas US$ 0,28/M token, mantendo o desempenho geral semelhante ao da versão anterior.