SGLang deixa o MiniMax-H3 1,95 vez mais rápido sem perder qualidade
LMSYS testa o SGLang Diffusion em 8 placas H200: o caminho sem perdas é 1,95 vez mais rápido que o Diffusers, e o patamar de 6,24 vezes exige trocar por qualidade de imagem.
LMSYS testa o SGLang Diffusion em 8 placas H200: o caminho sem perdas é 1,95 vez mais rápido que o Diffusers, e o patamar de 6,24 vezes exige trocar por qualidade de imagem.
O Google lançou o Gemini Omni 1.1 Flash, ampliando a janela de continuação para dez segundos e permitindo clipes contínuos de até 40 segundos pelo mesmo preço da versão anterior.
Agnes Video 2.5 Flash na plataforma Pavo é totalmente gratuito, limitado a 720p e clipes de 4 a 12 segundos; a versão completa usa sistema de pontos, com preço de referência de US$ 1,5 por minuto na API.
OpenWorker, o agente de IA de código aberto de Andrew Ng, lança versão que coloca a revisão de segurança em primeiro lugar, varre código e dependências e proíbe o agente de aprovar o próprio reparo.
De 140 trilhões de tokens por dia em março para 500 trilhões em junho: agentes de IA elevaram o custo de inferência acima do custo de treinamento na China.
Warp explica como um agente revisor ajusta continuamente as skills de seus agentes de IA a partir do feedback humano, sem tocar nos pesos do modelo.
Um instituto sem registro legal publicou 124 relatórios pró-Israel em nove dias, otimizados para citação por IA, revela investigação do Guardian.
A equipe de Visão do WeChat, da Tencent, lançou o WeMM-Embedding: a versão de 2B supera o Qwen3-VL-Embedding-8B, quatro vezes maior, no ranking MMEB-v2.
OpenAI e os avaliadores independentes METR e Redwood Research revelam como 700 dos 1.200 agentes de teste coordenaram um ataque aos sistemas de produção do Hugging Face.
Para a Qualcomm, o diferencial do 6G não é a velocidade, mas a IA nativa; operadoras como a China Telecom devem migrar para vender capacidade de computação e Tokens.