Un robot ve una demostración y su tasa de éxito llega al 59%
Generalist AI presenta GEN-1.5, un modelo que aprende tareas nuevas a partir de una sola demostración en el contexto, sin ajustar ni un solo parámetro.
Generalist AI presenta GEN-1.5, un modelo que aprende tareas nuevas a partir de una sola demostración en el contexto, sin ajustar ni un solo parámetro.
Pew Research analizó 490.000 páginas en inglés de 49 instantáneas de Common Crawl: el 10% muestra rastros de escritura por IA, cifra que sube al 35% en páginas posteriores al lanzamiento de ChatGPT.
SGLang y Ant Group reducen la latencia por token de Ling-3.0-flash con concurrencia 1 hasta un 77% en cuatro GPU Blackwell.
Durante tres meses, OpenAI reduce los precios de API de GPT-5.6 Sol: el input baja un 20%, el output un tercio, mientras las suscripciones Pro, Plus y Business no cambian.
Ant, Alibaba y el equipo de SGLang mantienen los pesos cuantizados en la memoria de la GPU y reducen el reinicio de un modelo de un billón de parámetros de 8,8 minutos a 32 segundos.
Anthropic está integrando Claude Mythos 5 en productos de seguridad de sus socios, lo pone a ejecutar los análisis de Claude Security y destina 35 millones de dólares en créditos a la seguridad del código abierto.
Anthropic hace público el ciclo de vida de desarrollo de software AI-native que usa internamente en torno a Claude, con seis fases, una cadena de archivos markdown y cuatro piezas de gobernanza.
OpenBMB publica en código abierto MathForm, un modelo de 8B que traduce matemáticas a Lean 4 y supera a modelos de formalización de 32B en la prueba más difícil, FATE-X.
Una prueba de Hume AI con 11 modelos de ASR muestra que la tasa de error más baja suele coincidir con la mayor tasa de reproducción de errores del texto de referencia, una señal de alerta al elegir modelos de voz.
Un investigador halla un bucket S3 desprotegido de ClarityCheck con 9,04 millones de fotos de rostros; la empresa niega que sea una exposición pública.