MiniMax-01 senkt Rechenleistung mit Lightning Attention
MiniMax-01 nutzt Lightning Attention, eine Variante der linearen Aufmerksamkeit, um die Rechenkomplexität von O(n²) auf nahezu O(n) zu reduzieren und so bei langen Kontexten deutliche Geschwindigkeitsvorteile zu erzielen.