DeepSeek V3.2 setzt auf Sparse Attention und halbiert Inferenzkosten
DeepSeek hat V3.2 mit einer neuen Sparse-Attention-Architektur veröffentlicht, die die Komplexität von O(L²) auf O(Lk) reduziert und die Inferenzkosten drastisch senkt – der Eingabepreis beträgt nur 0,28 $/M Token – während die Leistung im Vergleich zum Vorgänger weitgehend stabil bleibt.