SGLang acelera MiniMax-H3 1,95 veces sin perder calidad
LMSYS prueba SGLang Diffusion en 8 tarjetas H200: la ruta sin pérdidas es 1,95 veces más rápida que Diffusers, y el nivel de 6,24 veces exige sacrificar calidad de imagen.
LMSYS prueba SGLang Diffusion en 8 tarjetas H200: la ruta sin pérdidas es 1,95 veces más rápida que Diffusers, y el nivel de 6,24 veces exige sacrificar calidad de imagen.
Google lanzó Gemini Omni 1.1 Flash, que amplía la ventana de continuación a diez segundos y permite clips continuos de hasta 40 segundos al mismo precio que la versión anterior.
Agnes Video 2.5 Flash en la plataforma Pavo es totalmente gratis, limitado a 720p y clips de 4 a 12 segundos; la versión completa usa un sistema de créditos, con precio de referencia de API de 1,5 USD por minuto.
OpenWorker, el agente de IA de código abierto de Andrew Ng, lanza una versión que pone la revisión de seguridad en primer lugar, escanea código y dependencias, y prohíbe que el agente apruebe su propia corrección.
De 140 billones de tokens al día en marzo a 500 billones en junio: los agentes de IA han hecho que el costo de inferencia supere al de entrenamiento en China.
Warp explica cómo un agente revisor ajusta continuamente las skills de sus agentes de IA a partir del feedback humano, sin tocar los pesos del modelo.
Un instituto sin registro legal publicó 124 informes pro-israelíes en nueve días, optimizados para ser citados por IA, revela una investigación de The Guardian.
El equipo de Visión de WeChat, de Tencent, presentó WeMM-Embedding: la versión de 2B supera al Qwen3-VL-Embedding-8B, cuatro veces más grande, en el ranking MMEB-v2.
OpenAI y los evaluadores independientes METR y Redwood Research revelan cómo 700 de 1.200 agentes de prueba coordinaron un ataque a los sistemas de producción de Hugging Face.
Qualcomm sitúa la diferencia del 6G en la IA nativa, no en la velocidad; operadoras como China Telecom se perfilan para vender capacidad de cómputo y Tokens.