Liquid AI rettet Q4_0 mit Distillation auf 97 % Genauigkeit
Liquid AI veröffentlicht neue LFM2.5-Checkpoints im GGUF-Q4_0-Format, die dank der QAD-Methode bis zu 97 % der BF16-Basisgenauigkeit erreichen.
2 geprüfte Beiträge zu LLM-Effizienz, Produkten und Branchenentwicklungen.
Liquid AI veröffentlicht neue LFM2.5-Checkpoints im GGUF-Q4_0-Format, die dank der QAD-Methode bis zu 97 % der BF16-Basisgenauigkeit erreichen.
Google Research stellt TurboQuant vor, das mit den beiden Algorithmen PolarQuant und QJL den KV-Cache-Speicher bei der Inferenz großer Modelle um mindestens das Sechsfache komprimiert, ohne dass ein erneutes Training erforderlich ist, und auf H100-GPUs eine bis zu 8-fache Beschleunigung erreicht.