Liquid AI dùng chưng cất đưa độ chính xác Q4_0 trở lại 97%
Liquid AI phát hành loạt checkpoint LFM2.5 dạng GGUF Q4_0 dùng phương pháp QAD, khôi phục tới 97% độ chính xác so với bản BF16 gốc trên bốn kích thước mô hình.
2 bài đã kiểm chứng về Hiệu suất mô hình lớn, sản phẩm và diễn biến ngành.
Liquid AI phát hành loạt checkpoint LFM2.5 dạng GGUF Q4_0 dùng phương pháp QAD, khôi phục tới 97% độ chính xác so với bản BF16 gốc trên bốn kích thước mô hình.
Google Research công bố TurboQuant, kết hợp hai thuật toán PolarQuant và QJL để nén KV Cache trong suy luận mô hình lớn ít nhất 6 lần mà không cần huấn luyện lại, đạt tốc độ nhanh hơn tới 8 lần trên GPU H100.