Les mathématiciens Tristan Buckmaster, du Courant Institute de l'université de New York, et Levent Alpöge ont rendu publics trois résultats : l'explosion en temps fini de l'équation des milieux poreux incompressibles, des équations de Boussinesq et des équations d'Euler incompressibles en trois dimensions, sous des termes de force extérieure lisses. Le même jour, Buckmaster a publié sur sa page personnelle une déclaration de quatre pages qui ne parlait pas de mathématiques.
La partie mathématique
Le point de départ de ce travail ne vient pas d'eux deux. La déclaration est directe à ce sujet : l'idée de base revient à Diego Córdoba et Luis Martínez-Zoroa, qui construisent depuis plusieurs années des solutions d'explosion avec termes de force, n'ayant jusqu'ici obtenu de résultats qu'avec des termes de force rugueux. Ce qu'ont fait Buckmaster et Alpöge, c'est prolonger ce résultat jusqu'aux termes de force lisses et aux équations d'Euler.
"I believe Luis Martínez-Zoroa deserves a Fields Medal."
La déclaration situe la chronologie au jour près. La progression a été lente pendant la dernière année ; le 15 août, ils ont obtenu le résultat d'explosion à force lisse pour Boussinesq et Euler ; le 22 août, la vérification dans Lean était achevée. Il décrit la première version de la démonstration générée par le modèle, envoyée par Alpöge, comme la pire qu'il ait jamais lue, et dit l'avoir depuis transformée en quelque chose de lisible par des humains. Parmi les modèles utilisés figurent Claude d'Anthropic et Codex d'OpenAI (principalement GPT-5.6 Sol) ; Astra n'a servi qu'à la rédaction et à la relecture de l'argumentation.
Terence Tao a commenté ce travail sur son blog le 7 septembre, estimant que la démonstration sur ces trois modèles simplifiés rendait des objectifs plus ambitieux "d'apparence très réalisable", et jugeant très probable que le même ensemble de techniques puisse s'étendre à Navier-Stokes. Il a aussi noté qu'à l'ère des agents d'autoformalisation, formaliser ce type de travail dans Lean était devenu assez réalisable.
L'autre moitié de la déclaration
Le 3 septembre, Buckmaster a entendu des rumeurs selon lesquelles Anthropic aurait résolu un important problème ouvert, tandis qu'Alpöge apprenait que leur avancée était parvenue jusqu'à OpenAI. Il a écrit à un mathématicien d'OpenAI pour expliquer la situation ; celui-ci a répondu le jour même, disant vouloir éviter un chevauchement et proposant de mettre à disposition de la puissance de calcul.
Dans l'après-midi du 6 septembre, Buckmaster a eu deux appels avec Sébastien Bubeck et d'autres personnes. On lui a dit qu'un modèle interne d'OpenAI avait démontré l'explosion en temps fini des équations de Navier-Stokes avec terme de force, sur une démonstration d'environ 100 pages. Selon la déclaration, les détails n'ont cessé d'être corrigés pendant l'appel : au départ, on lui a dit que le modèle n'avait reçu que l'énoncé du problème, avec très peu d'intervention humaine ; puis il s'est avéré qu'une équipe entière y avait travaillé, que le modèle avait d'abord résolu des problèmes plus simples dont Euler, et que même le prompt qu'on lui a montré avait été rédigé avec Codex. À sa question de savoir quand le premier prompt avait été envoyé, on lui a répondu, après plusieurs relances, que c'était dans les derniers jours — c'est-à-dire après que leur travail eut atteint OpenAI.
Il a également demandé si le modèle avait été entraîné sur les sessions Codex que tout leur projet utilisait, ou y avait eu accès. Selon la déclaration, la réponse a été que le modèle ne consulte pas les données des utilisateurs ; sur la question de l'entraînement, aucune réponse n'a été donnée.
La déclaration indique que l'autre partie a proposé deux options, toutes deux liées à la paternité d'Alpöge, avec une justification tenant au fait qu'il travaille chez Anthropic. Buckmaster affirme avoir refusé les deux, et avoir prévenu que si l'autre partie publiait de cette façon, il rendrait le déroulement des faits public.
Bubeck a réagi sur X le 8 septembre, qualifiant les accusations en circulation de "fausses et incendiaires", affirmant n'avoir participé à la discussion que selon l'usage académique, et promettant une explication plus complète le lendemain. Au moment de la publication, il n'avait pas répondu point par point sur les données de Codex, l'arrangement concernant la paternité ni les détails de l'appel ; OpenAI n'a pas non plus fait de déclaration institutionnelle.
Ce qui diffère des fois précédentes
Au cours de la dernière année, le scénario de ce type d'actualité était figé : un laboratoire annonce qu'un modèle a résolu un problème ouvert, avec un lien vers l'évaluation ou la démonstration, et la discussion porte sur le résultat lui-même. La démonstration mécanique complète du dernier théorème de Fermat, ou le cas de la conjecture d'Erdős, ont suivi ce même schéma.
Cette fois, la différence est que le désaccord ne porte pas sur la validité de la démonstration, mais sur qui l'a fait en premier, qui est crédité, et si quelqu'un a vu le travail de l'autre partie au stade de brouillon. Buckmaster trace lui-même une limite dans sa déclaration : il n'a jamais vu la démonstration d'OpenAI, ignore ce qu'a fait le modèle, n'accuse personne, et se contente de rapporter ce qu'on lui a dit, quand, et ce que l'autre partie a proposé.
Ce qu'il voulait vraiment aborder, c'était autre chose : le fait qu'un mathématicien associé à un modèle puisse accomplir tout cela en un mois, et ce que cela signifie pour la formation des étudiants, l'attribution de la paternité et l'évaluation par les pairs. Il a qualifié cela de moment à la Deep Blue contre Kasparov, avant d'écrire qu'il devait d'abord rédiger ce texte-ci.
Sources : texte intégral de la déclaration sur la page personnelle de Tristan Buckmaster, CocoLoop, blog What's New de Terence Tao, réaction de Sébastien Bubeck sur X, Analytics India Magazine ; la chronologie et les citations suivent le texte original de la déclaration, et le camp d'OpenAI ne compte pour l'instant qu'une seule publication personnelle.