SGLang deixa o MiniMax-H3 1,95 vez mais rápido sem perder qualidade
LMSYS testa o SGLang Diffusion em 8 placas H200: o caminho sem perdas é 1,95 vez mais rápido que o Diffusers, e o patamar de 6,24 vezes exige trocar por qualidade de imagem.
10 artigos verificados sobre MiniMax, produtos e movimentos do setor.
LMSYS testa o SGLang Diffusion em 8 placas H200: o caminho sem perdas é 1,95 vez mais rápido que o Diffusers, e o patamar de 6,24 vezes exige trocar por qualidade de imagem.
A MiniMax lançou o Design, uma plataforma criativa multimodal que usa agentes de IA para encadear clipes de 15 segundos do modelo H3 em filmes de até 3 minutos, mirando fluxos de edição profissional.
O MiniMax H3 combina vídeo 2K de 15 segundos, estéreo nativo, preço de RMB 0,8 por segundo e promessa de pesos abertos.
MiniMax capta mais HK$16 bi. Uma leitura local dos fatos verificados e do sinal setorial por trás da notícia.
Zhipu e MiniMax enfrentam teste de lock-up em Hong Kong. O texto resume os pontos centrais, os números-chave, a posição das empresas e o efeito para mercado ou regulação.
A MiniMax lançou o modelo de pesos abertos M3 com contexto de 1 milhão de tokens, capacidade de codificação avançada e multimodalidade nativa, afirmando ser o primeiro a combinar os três.
MiniMax M2.7 usa o framework de agente OpenClaw para executar automaticamente experimentos, ler logs, analisar métricas e ajustar código por mais de 100 ciclos sem intervenção humana, resultando em um aumento de 30% nas métricas de avaliação internas. O modelo tem 230B parâmetros, mas ativa apenas 10B por inferência, e foi disponibilizado como código aberto.
A MiniMax apresenta a série de modelos de raciocínio M1, focada em matemática, programação e análise lógica. A versão aprimorada M2.5 alcançou 80,2% no SWE-bench Verified, posicionando-se entre os líderes globais.
A MiniMax, empresa discreta no cenário de IA chinês, construiu uma reputação considerável com a capacidade de geração de vídeo do Hailuo AI, destacando-se em qualidade e velocidade.
MiniMax-01 utiliza Lightning Attention, uma variante da atenção linear, para reduzir a complexidade computacional de O(n²) para perto de O(n), proporcionando ganhos significativos de velocidade em contextos longos.