Un faux think tank a nourri les IA de 124 rapports pro-Israël
Un think tank sans existence légale a publié 124 rapports pro-israéliens en neuf jours, optimisés pour être cités par l'IA, révèle une enquête du Guardian.
30 articles vérifiés sur Recherche IA, les produits et le secteur.
Un think tank sans existence légale a publié 124 rapports pro-israéliens en neuf jours, optimisés pour être cités par l'IA, révèle une enquête du Guardian.
Anthropic ouvre les données d'usage de Claude à Stanford, Oxford et METR pour une recherche indépendante, avec un audit de confidentialité de l'Imperial College London ; plus de la moitié des conversations concernent des tâches à enjeu réel.
Le benchmark FORGE montre qu'une seule page web piégée suffit à faire recommander des produits inexistants par des IA de recherche, jusqu'à 27 % des cas.
Un test de Hume AI sur 11 modèles ASR montre que le taux d'erreur le plus bas coïncide souvent avec le taux le plus élevé de reproduction des erreurs du texte de référence, un signal d'alarme pour le choix des modèles vocaux.
Mistral lance Agentic Search : cinq outils que le modèle utilise lui-même de façon itérative, au lieu d'une récupération unique. La précision sur FinanceBench passe de 26,7 % à 86 %, avec moins de tokens et de latence.
Dans un article de douze pages sur arXiv, Terence Tao avertit que si l'IA résout des preuves de recherche pour quelques dizaines à quelques centaines de dollars, les mathématiques basculeront vers la surabondance.
Prime Intellect a fait mener à 18 modèles d'IA 153 expériences autonomes sur nanoGPT : le meilleur comble 82 % de l'écart avec le record humain, mais aucun n'a proposé de méthode nouvelle.
Anthropic publie une expérience : Claude conçoit des molécules liantes pour 15 cibles protéiques avec un taux de réussite bien supérieur à la moyenne du secteur, avec un simple modèle conversationnel.
Aureka Biotechnologies boucle une série B de 100 millions de dollars pour entraîner des modèles biologiques de fondation et renforcer sa boucle de laboratoire.
Anthropic affirme qu'une version de recherche non publiée de Claude a amélioré une borne liée aux zéros de la fonction zêta de Riemann de 41,6% à 67,2%.
BigBang-V1 transforme les donnees synthetiques en boucle agentique de creation, resolution, verification et filtrage de taches.
OpenAI présente Astra avec dix résultats en mathématiques et informatique théorique, accompagnés d'un article de 249 pages, de certificats Lean et de parcours de raisonnement.
Google ATLAS analyse 14,65 millions d’interactions Gemini et montre une adoption large, mais une faible profondeur de tâches et peu d’automatisation complète.
Une étude Nature du MIT, de Cambridge, Princeton et leurs partenaires suggère que les humains comprennent les nouveaux jeux par simulation rapide, plate et orientée but, plutôt que par recherche profonde.
Oak Lab fixe un objectif de 20 watts pour des agents apprenants en continu. L’article résume les faits vérifiés et le signal au-delà d’une annonce isolée.
AnySearch arrive en tête de Product Hunt avec une recherche conçue pour agents IA. L’article résume les faits vérifiés et le signal au-delà d’une annonce isolée.
GPT-5.6 produit une preuve de théorie des graphes. Une version localisée des faits vérifiés et du signal industriel sous-jacent.
ICML 2026 récompense deux travaux sur la diffusion est adapté pour les lecteurs tech francophones, avec les chiffres clés et les points à vérifier.
Anthropic lance Claude Science pour les laboratoires. L’article résume les points clés, les chiffres importants, la position des entreprises et l’effet pour le marché ou la régulation.
Anthropic présente Claude Science comme atelier vérifiable。
Le mouvement montre que la compétition IA ne se joue plus seulement sur les modèles ou les outils, mais aussi sur le capital, l’adoption client et la réponse réglementaire.
OpenAI affirme désormais que tout automatiser n’est pas l’avenir voulu, passant du chercheur IA autonome au travail avec les humains.
Google ajoute dans Search Console des contrôles pour exclure un site d’AI Overviews, d’AI Mode et des résumés IA dans Discover, d’abord auprès d’éditeurs britanniques.
Le pionnier de l’apprentissage par renforcement estime que les modèles de prochain token manquent de causalité, d’expérience et d’expérimentation.
Exa Labs boucle un tour de table Série C de 250 millions de dollars mené par a16z, triplant sa valorisation en six mois.
Aletheia, la dernière IA mathématique de DeepMind, a résolu 6 des 10 problèmes de recherche non publiés du défi FirstProof, dont 5 solutions ont été évaluées par des experts externes comme publiable après des révisions mineures.
World Labs de Fei-Fei Li mise sur l’intelligence spatiale. L’article résume l’annonce, le contexte stratégique et les risques pratiques pour les utilisateurs ou entreprises concernés.
Google a lancé la fonctionnalité Notebooks dans Gemini, intégrant directement NotebookLM dans le flux de travail principal de l'assistant IA, et a connecté Deep Research pour gérer les connaissances personnelles.
Yann LeCun fonde AMI Labs, boucle un tour de table seed de 1,03 milliard de dollars valorisé à 3,5 milliards, et annonce vouloir construire une IA qui ne fonctionne pas en prédisant le mot suivant.
Perplexity a connu une forte croissance ces deux dernières années, créant une brèche dans le marché de la recherche dominé par Google en fournissant des réponses directes plutôt que des listes de liens, en s'appuyant sur des modèles externes comme GPT et Claude et son propre système RAG.