News - Cocoloop
InícioClaudeOpenAIGeminiDeepSeekCódigo abertoTodas as tagsArquivo
文/A PT ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

Notícias e análises sobre eficiência de grandes modelos

2 artigos verificados sobre eficiência de grandes modelos, produtos e movimentos do setor.

IA no dispositivo 2026-08-19

Liquid AI usa destilação para recuperar 97% de precisão do Q4_0

Liquid AI lança novos checkpoints da série LFM2.5 em formato GGUF Q4_0, treinados com o método QAD, recuperando até 97% da precisão original em BF16.

#Código aberto#otimização de inferência de IA#eficiência de grandes modelos
Google 2026-04-20

Google TurboQuant comprime memória de inferência de IA em 6 vezes

O Google Research apresentou o TurboQuant, que combina os algoritmos PolarQuant e QJL para comprimir a memória do KV Cache durante a inferência de grandes modelos em pelo menos 6 vezes sem necessidade de retreinamento, alcançando até 8 vezes mais velocidade em GPUs H100.

#otimização de inferência de IA#eficiência de grandes modelos#avanço tecnológico

News · Cocoloop

Notícias e análises de IA sobre modelos de fronteira, comunidades open source e movimentos da indústria, editadas pela Cocoloop a partir de fontes públicas verificadas.

Notícias de modelos

  • Claude
  • OpenAI
  • Gemini
  • DeepSeek
  • Qwen

Temas

  • Código aberto
  • Programação com IA
  • Agent
  • Todas as tags

Site

  • Início
  • Arquivo de artigos
  • RSS
  • robots.txt
  • Padrões editoriais

Links

  • Site principal da Cocoloop
  • Perguntas e respostas
  • Guia Hermes
  • Imagens IA PixPix
  • Comunidade de imagens IA
文/A PT ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

© 2026 News · Cocoloop — Notícias de IA de fronteira

Sitemap