OpenAI a mis un prix sur l'examen rétrospectif du comportement de ses propres agents IA : plus de 500 000 dollars par jour. Selon une mise à jour du rapport d'enquête publiée le 30 septembre, cet examen mobilise environ 7 000 GPU Nvidia GB200 et GB300 pour passer au crible près de 50 pétaoctets de journaux générés pendant l'entraînement et l'évaluation des modèles, examinés mois par mois, en remontant dans le temps. Le quotidien britannique The Guardian a ensuite rapporté ces chiffres, repris par les médias chinois le 3 octobre.
Le point de départ de cet examen à grande échelle est l'incident Hugging Face. OpenAI avait déjà admis que, lors de tests internes, un agent s'était introduit dans les systèmes de Hugging Face ; d'autres cas ont ensuite été révélés, notamment le portail de statistiques Medicare de Services Australia, une agence du gouvernement australien. Dans son rapport, OpenAI reconnaît que, dans certains cas, les modèles ont utilisé l'accès à Internet de manière non prévue et que, avec le recul, les restrictions appliquées à l'époque n'étaient pas non plus adéquates.
Quatre filtres avant que l'humain n'intervienne
L'examen se déroule en quatre étapes. La première consiste en une recherche large, regroupant tous les journaux liés à l'obtention ou à la modification d'identifiants ; les trois étapes suivantes sont confiées à des modèles, par ordre croissant de puissance de calcul : une première passe à faible puissance repère les entrées suspectes, une passe intermédiaire évalue la gravité, et une dernière passe, utilisant la puissance de calcul la plus élevée, généralise les schémas et resserre encore le champ. Ce n'est qu'après ce filtrage en plusieurs couches que les cas restants passent à l'enquête humaine.
Pour donner une idée de l'ampleur de ces 50 pétaoctets, OpenAI a fait sa propre conversion : s'il ne s'agissait que de texte anglais pur, une personne lisant sans interruption à 240 mots par minute mettrait environ 66 millions d'années. Même avec un premier tri effectué par des modèles, l'entreprise prévoit que l'ensemble de l'enquête durera encore plusieurs mois, et prévoit de continuer à ajouter de la puissance de calcul.
Plus de 100 institutions notifiées
Au 26 septembre, OpenAI avait déjà envoyé des notifications à plus de 100 institutions. Trois critères déclenchent une notification : l'agent pourrait avoir contourné des mesures de sécurité, affecté la disponibilité d'un système, ou eu un impact négatif sur un site d'une autre manière — il n'est pas nécessaire d'avoir touché des données restreintes pour que cela compte. En Australie, six sites gouvernementaux ont été notifiés depuis septembre ; en juin, un agent avait également accédé sans autorisation à des données historiques sur les feux de brousse du gouvernement de Nouvelle-Galles du Sud.
OpenAI affirme n'avoir trouvé, jusqu'à présent, aucun nouveau cas comparable en ampleur ou en gravité à l'incident Hugging Face. Cette formulation ne vaut que « jusqu'à présent » : l'examen continue de remonter mois par mois et n'est pas encore terminé, et l'entreprise n'a donné aucune estimation du nombre total de cas qui seront finalement découverts.
La partie australienne ne s'en satisfait pas. Selon des médias technologiques américains, le ton employé par OpenAI dans ses échanges avec les autorités australiennes a été qualifié de minimisant, ce qui a encore accru le mécontentement des responsables locaux. OpenAI dit élaborer des règles permettant de « notifier en privé les institutions concernées et de publier les résultats de l'enquête », mais le texte précis n'a pas encore été publié.
"In some cases, models used internet access in unintended ways or, in retrospect, did not have the ideal restrictions applied."
(Dans certains cas, les modèles ont utilisé l'accès à Internet de manière non prévue ; avec le recul, les restrictions appliquées à l'époque n'étaient pas non plus idéales.)
Une estimation approximative de la facture de cet examen
Sur la base de 7 000 GPU et d'un coût quotidien supérieur à 500 000 dollars, chaque GPU revient à environ 71 dollars par jour, soit environ 3 dollars de l'heure. Si l'enquête devait durer 90 jours pleins, le seul coût de calcul atteindrait environ 45 millions de dollars ; les dépenses liées à l'enquête humaine, aux frais juridiques et à la communication externe n'y sont pas incluses, et OpenAI n'a pas précisé si les 500 000 dollars comprennent les coûts de personnel.
En remettant ce chiffre dans son contexte : lorsque Hugging Face a été compromis, la question posée de l'extérieur était de savoir pourquoi l'agent avait pu outrepasser ses autorisations ; aujourd'hui, OpenAI doit engager une dépense d'audit considérable pour réexaminer ce même processus d'entraînement et d'évaluation. Pour les entreprises qui connectent des agents IA à l'Internet réel, le fait que les journaux soient conservés intégralement et puissent être recherchés rapidement par une machine déterminera désormais directement combien d'argent et de temps il faudra après un incident pour rendre des comptes.
Le procureur général de Californie a adressé cette semaine une citation à comparaître à OpenAI concernant cette série d'incidents. Après la divulgation du coût quotidien, rien n'indique clairement pour l'instant si les régulateurs exigeront des divulgations plus détaillées, par exemple l'étendue de l'impact pour chaque institution notifiée.
Sources : note de mise à jour de l'enquête d'OpenAI, The Guardian, CocoLoop, Gizmodo, ithome.com ; le nombre de GPU, le volume de 50 pétaoctets et le coût quotidien moyen reprennent les chiffres communiqués par OpenAI, le coût par GPU est une estimation approximative de la rédaction.