Liquid AI usa destilação para recuperar 97% de precisão do Q4_0
Liquid AI lança novos checkpoints da série LFM2.5 em formato GGUF Q4_0, treinados com o método QAD, recuperando até 97% da precisão original em BF16.
2 artigos verificados sobre eficiência de grandes modelos, produtos e movimentos do setor.
Liquid AI lança novos checkpoints da série LFM2.5 em formato GGUF Q4_0, treinados com o método QAD, recuperando até 97% da precisão original em BF16.
O Google Research apresentou o TurboQuant, que combina os algoritmos PolarQuant e QJL para comprimir a memória do KV Cache durante a inferência de grandes modelos em pelo menos 6 vezes sem necessidade de retreinamento, alcançando até 8 vezes mais velocidade em GPUs H100.