Les trois chercheurs en sécurité licenciés par OpenAI la semaine dernière, Jasmine Wang, Tomek Korbak et Mikita Balesni, ont publié le 8 octobre une lettre ouverte commune. Ils y contestent les accusations de l'entreprise et préviennent que ces licenciements ont rendu les collègues restés en poste craintifs à l'idée de s'exprimer. Un jour plus tard, OpenAI a répondu par un communiqué sur X : la décision de licencier est maintenue, et l'enquête interne a révélé des problèmes plus graves que ceux évoqués dans la lettre.
Ce que chacun s'est vu dire
La lettre est intitulée « OpenAI cannot make AI safe on its own » et s'adresse au Comité de sûreté et de sécurité, au Groupe consultatif sur la sécurité et au Comité consultatif sur la mission d'OpenAI. Sa partie la plus concrète est celle où chacun relate le motif de licenciement qui lui a été communiqué.
Korbak affirme qu'on ne le lui a dit qu'oralement : la raison serait sa façon de communiquer avec l'organisme d'évaluation externe METR. Aucun détail sur ce qu'il aurait dit ou fait, ni sur le moment, et aucun document écrit. Il estime que dialoguer avec METR faisait partie de son travail. METR avait enquêté avec OpenAI sur l'incident au cours duquel un agent d'IA avait pénétré dans Hugging Face.
Balesni raconte que, lors de l'entretien de départ, l'entreprise lui a dit ne plus avoir confiance en lui parce qu'il avait eu trop de contacts avec des organisations de sécurité tierces, laissant entendre qu'il aurait divulgué de la propriété intellectuelle. Il assure n'avoir jamais partagé la propriété intellectuelle de l'entreprise, et que le travail en question avait été coordonné avec son supérieur direct, le responsable de la recherche et le conseil d'administration. Sur X, il a écrit croire que les trois ont été licenciés pour avoir placé la sécurité avant les intérêts à court terme de l'entreprise.
Wang s'est vu indiquer comme motif l'accès à la boîte mail d'un dirigeant. Selon elle, cette autorisation avait été ouverte à l'origine pour des tâches de recrutement ; elle a demandé à l'informatique de la retirer, sans suite. Après avoir ouvert par erreur un message sensible, elle a prévenu le dirigeant concerné en quelques minutes. Elle demande à l'entreprise une liste complète et écrite des accusations.
Les trois nient en outre être à l'origine d'une fuite. Des médias avaient auparavant rapporté des discussions internes chez OpenAI sur des « architectures de modèles plus difficiles à surveiller » ; la lettre indique expressément : « We were not the source of the leak ».
La réponse d'OpenAI
Le communiqué d'OpenAI a été publié par un responsable de la recherche, dont le nom n'apparaît pas dans la plupart des articles. Il comporte quatre points essentiels : l'enquête a confirmé que les trois ont enfreint des politiques claires sur le traitement des informations sensibles ; les manquements à la confiance constatés dépassent ce que décrit la lettre ; par principe, les détails individuels ne sont pas rendus publics ; et les licenciements n'ont aucun rapport avec les inquiétudes de sécurité qu'ils avaient soulevées.
"We have not and do not terminate any of our employees for raising concerns."
(Nous n'avons jamais licencié et ne licencions aucun employé pour avoir exprimé des inquiétudes.)
Le communiqué contient aussi des points d'accord. OpenAI dit partager l'avis de la lettre selon lequel maintenir les modèles de pointe surveillables exige l'investissement de toute l'industrie, y compris d'OpenAI elle-même, et affirme être en train de finaliser des contrats avec des évaluateurs de sécurité tiers, dont les détails seront annoncés dans les prochaines semaines. On ignore pour l'instant de quelles organisations il s'agit et si ces contrats autoriseront les chercheurs à échanger directement avec les évaluateurs externes.
Mettre bout à bout les licenciements de ces deux dernières années
Ce n'est pas la première fois qu'OpenAI licencie des chercheurs pour cause de fuite. En avril 2024, Leopold Aschenbrenner et Pavel Izmailov, de l'équipe de superalignement, ont été renvoyés pour une présumée divulgation d'informations. Aschenbrenner avait lui aussi répliqué publiquement, affirmant avoir été visé pour avoir soulevé en interne des problèmes de sécurité.
Deux ans plus tard, la chronologie de cette nouvelle affaire est plus serrée : le 1er octobre, le Wall Street Journal révèle les licenciements ; le 3 octobre, David Robinson, responsable des system cards, publie dans The Atlantic un texte expliquant pourquoi il est parti ; le 8 octobre, la lettre ouverte est diffusée ; le 9 octobre, OpenAI répond.
Par rapport à 2024, le cœur de la controverse est passé de « y a-t-il eu une fuite ou non » à la frontière entre les chercheurs du laboratoire et les organismes d'évaluation externes. La lettre dit que les politiques internes étaient alors encore « en cours d'élaboration », tandis qu'OpenAI affirme qu'elles étaient claires. Les deux camps s'accordent sur l'importance de l'évaluation indépendante ; le désaccord porte sur qui a franchi la ligne.
Balesni craint que l'entreprise ne profite de ces licenciements pour rompre la collaboration avec METR. Aucune réaction de METR n'apparaît pour l'instant dans les articles publics, et OpenAI n'a pas divulgué le contenu précis des manquements. D'ici la publication des contrats d'évaluation par des tiers, l'extérieur ne dispose, pour juger, que des récits de chaque camp.
Sources : communiqué officiel d'OpenAI, TechCrunch, CocoLoop, texte intégral de la lettre ouverte publié par Newsweek, Reuters, AFP ; la lettre des trois chercheurs et leurs comptes personnels sur les réseaux sociaux ont servi à recouper les déclarations de chacun, CNBC à vérifier les citations du communiqué.