Un robot regarde une démonstration, son taux de réussite atteint 59 %
Avec GEN-1.5, Generalist AI montre qu'un robot peut apprendre une nouvelle tâche à partir d'une seule démonstration en contexte, sans toucher au moindre paramètre.
Avec GEN-1.5, Generalist AI montre qu'un robot peut apprendre une nouvelle tâche à partir d'une seule démonstration en contexte, sans toucher au moindre paramètre.
Le Pew Research Center a analysé 490 000 pages en anglais issues de 49 instantanés de Common Crawl : 10 % montrent des traces d'écriture par IA, une part qui grimpe à 35 % pour les pages postérieures à ChatGPT.
SGLang et Ant Group réduisent la latence par token de Ling-3.0-flash à concurrence 1, jusqu'à 77 % sur quatre GPU Blackwell.
Pendant trois mois, OpenAI réduit les prix d'API de GPT-5.6 Sol : l'input baisse de 20%, l'output d'un tiers, tandis que les abonnements Pro, Plus et Business restent inchangés.
Ant, Alibaba et l'équipe SGLang gardent les poids quantifiés en mémoire GPU et font passer le redémarrage d'un modèle de mille milliards de paramètres de 8,8 minutes à 32 secondes.
Anthropic intègre Claude Mythos 5 aux produits de sécurité de ses partenaires, le fait tourner derrière les analyses de Claude Security et consacre 35 millions de dollars de crédits à la sécurité de l'open source.
Anthropic rend public son cycle de vie de développement logiciel AI-native utilisé en interne autour de Claude, en six phases, une chaîne de fichiers markdown et quatre dispositifs de gouvernance.
OpenBMB publie en open source MathForm, un modèle 8B qui traduit les mathématiques en Lean 4 et dépasse des modèles de formalisation 32B sur le test le plus difficile, FATE-X.
Un test de Hume AI sur 11 modèles ASR montre que le taux d'erreur le plus bas coïncide souvent avec le taux le plus élevé de reproduction des erreurs du texte de référence, un signal d'alarme pour le choix des modèles vocaux.
Bucket S3 non sécurisé de ClarityCheck exposant 9,04 millions de photos de visages ; l'entreprise nie une exposition publique.