SGLang acelera MiniMax-H3 1,95 veces sin perder calidad
LMSYS prueba SGLang Diffusion en 8 tarjetas H200: la ruta sin pérdidas es 1,95 veces más rápida que Diffusers, y el nivel de 6,24 veces exige sacrificar calidad de imagen.
10 artículos verificados sobre MiniMax, productos y movimientos del sector.
LMSYS prueba SGLang Diffusion en 8 tarjetas H200: la ruta sin pérdidas es 1,95 veces más rápida que Diffusers, y el nivel de 6,24 veces exige sacrificar calidad de imagen.
MiniMax presentó Design, una plataforma creativa multimodal que usa agentes de IA para encadenar clips de 15 segundos del modelo H3 en películas de hasta 3 minutos, apuntando a los flujos de edición profesional.
MiniMax H3 combina video 2K de 15 segundos, estéreo nativo, precio de 0,8 yuanes por segundo y promesa de pesos abiertos.
MiniMax levanta otros 16.000 millones de HKD. Una localización breve de los hechos verificados y la señal industrial de fondo.
Zhipu y MiniMax afrontan el fin del lock-up en Hong Kong. El texto resume los puntos clave, las cifras principales, la postura de las empresas y su efecto en mercado o regulación.
MiniMax lanzó el modelo de pesos abiertos M3 con contexto de 1 millón de tokens, capacidad de codificación de vanguardia y multimodalidad nativa, afirmando ser el primero en combinar los tres.
MiniMax M2.7 utiliza el framework de agente OpenClaw para ejecutar automáticamente experimentos, leer registros, analizar métricas y ajustar código durante más de 100 ciclos sin intervención humana, logrando un aumento del 30% en las métricas de evaluación internas. El modelo tiene 230B parámetros, pero solo activa 10B por inferencia, y se ha publicado como código abierto.
MiniMax presenta la serie de modelos de razonamiento M1, centrada en matemáticas, programación y análisis lógico. La versión mejorada M2.5 alcanzó un 80,2 % en SWE-bench Verified, situándose en el primer nivel mundial.
MiniMax, una empresa discreta en el círculo de IA chino, ha construido una reputación considerable con la capacidad de generación de video de Hailuo AI, destacando en calidad y velocidad.
MiniMax-01 emplea Lightning Attention, una variante de la atención lineal, para reducir la complejidad computacional de O(n²) a casi O(n), logrando importantes ganancias de velocidad en contextos largos.