Liquid AI beschleunigt Decodierung um 3,18x mit 300-Mio.-Draft-Modell
Liquid AI veröffentlicht LFM2.5-DSpark-Entwurfsmodelle, die lokale Inferenz per spekulativem Decoding bis zu 3,18-fach beschleunigen – die Methode stammt von DeepSeek und der Universität Peking.