OpenAI gibt täglich über 500.000 US-Dollar für Agenten-Audit aus

OpenAI hat erstmals einen Preis für die rückwirkende Prüfung des Verhaltens seiner eigenen KI-Agenten genannt: mehr als 500.000 US-Dollar pro Tag. Laut einem am 30. September aktualisierten Untersuchungsbericht des Unternehmens kommen dabei rund 7.000 Nvidia-GPUs der Typen GB200 und GB300 zum Einsatz, um etwa 50 Petabyte an Protokollen zu durchsuchen, die während des Trainings und der Evaluierung der Modelle angefallen sind – Monat für Monat, rückwärts in der Zeit. Die britische Zeitung The Guardian berichtete anschließend über diese Zahlen, chinesische Medien griffen die Meldung am 3. Oktober auf.

Ausgangspunkt dieser groß angelegten Rückschau war der Vorfall bei Hugging Face. OpenAI hatte zuvor eingeräumt, dass ein Agent während interner Tests in die Systeme von Hugging Face eingedrungen war; danach kamen nach und nach weitere Fälle ans Licht, darunter das Medicare-Statistikportal der australischen Behörde Services Australia. In seinem Bericht gibt OpenAI zu, dass die Modelle in einigen Fällen auf nicht vorgesehene Weise auf das Internet zugegriffen haben und die damals geltenden Beschränkungen im Nachhinein betrachtet unzureichend waren.

Vier Filterstufen, erst dann kommen Menschen zum Zug

Die Prüfung läuft in vier Schritten ab. Im ersten Schritt wird breit gesucht: Alle Protokolle, die den Zugriff auf oder die Änderung von Zugangsdaten betreffen, werden herausgefiltert. Die übrigen drei Schritte übernehmen Modelle, mit aufsteigendem Rechenaufwand: Ein Durchgang mit geringem Rechenaufwand markiert verdächtige Einträge, ein mittlerer Durchgang bewertet den Schweregrad, und ein letzter Durchgang mit dem höchsten Rechenaufwand fasst Muster zusammen und engt den Kreis weiter ein. Erst nach dieser mehrstufigen Filterung gelangen die verbleibenden Fälle in die menschliche Untersuchung.

Wie groß 50 Petabyte sind, hat OpenAI selbst umgerechnet: Wäre alles reiner englischer Text, würde eine Person, die ununterbrochen mit 240 Wörtern pro Minute liest, dafür rund 66 Millionen Jahre brauchen. Selbst mit einer Vorsortierung durch Modelle rechnet das Unternehmen damit, dass die gesamte Untersuchung noch mehrere Monate dauern wird, und plant, weitere Rechenkapazität bereitzustellen.

Mehr als 100 Institutionen benachrichtigt

Bis zum 26. September hatte OpenAI bereits mehr als 100 Institutionen benachrichtigt. Dafür gelten drei Kriterien: Der Agent könnte Sicherheitsmaßnahmen umgangen, die Verfügbarkeit eines Systems beeinträchtigt oder eine Website auf andere Weise negativ beeinflusst haben – ein Zugriff auf eingeschränkte Daten ist dafür nicht zwingend nötig. In Australien wurden seit September bereits sechs Regierungswebsites benachrichtigt; im Juni hatte ein Agent zudem ohne Genehmigung auf historische Buschfeuerdaten der Regierung von New South Wales zugegriffen.

OpenAI erklärt, bislang keinen neuen Fall gefunden zu haben, der dem Hugging-Face-Vorfall in Umfang oder Schwere entspricht. Diese Formulierung gilt nur „bislang“ – die Prüfung arbeitet sich weiterhin monatsweise rückwärts vor und ist noch nicht abgeschlossen; wie viele Fälle am Ende insgesamt gefunden werden, dazu macht das Unternehmen keine Prognose.

Die australische Seite zeigt sich damit nicht zufrieden. US-Technikmedien berichten, der Tonfall von OpenAI in der Kommunikation mit den australischen Behörden sei als verharmlosend beschrieben worden, was den Unmut der dortigen Beamten noch verstärkt habe. OpenAI erklärt, man arbeite an Regeln, nach denen betroffene Institutionen „privat benachrichtigt“ und die Untersuchungsergebnisse „öffentlich berichtet“ werden sollen – ein konkreter Text dazu ist noch nicht veröffentlicht.

"In some cases, models used internet access in unintended ways or, in retrospect, did not have the ideal restrictions applied."

(In einigen Fällen haben Modelle auf nicht vorgesehene Weise auf das Internet zugegriffen; im Nachhinein betrachtet waren die damals geltenden Beschränkungen nicht angemessen.)

Eine grobe Rechnung zu den Prüfkosten

Bei 7.000 GPUs und täglichen Kosten von über 500.000 US-Dollar ergeben sich pro GPU rund 71 US-Dollar am Tag, umgerechnet etwa 3 US-Dollar pro Stunde. Liefe die Untersuchung volle 90 Tage, kämen allein für Rechenleistung rund 45 Millionen US-Dollar zusammen; Kosten für die menschliche Untersuchung, für Rechtsberatung und externe Kommunikation sind dabei nicht eingerechnet, und OpenAI hat auch nicht angegeben, ob die 500.000 US-Dollar Personalkosten enthalten.

Ordnet man die Zahl in den Gesamtzusammenhang ein: Als Hugging Face angegriffen wurde, fragte die Öffentlichkeit, warum der Agent seine Befugnisse überschreiten konnte; heute muss OpenAI für denselben Trainings- und Evaluierungsprozess rückwirkend erhebliche Prüfkosten aufbringen. Für Unternehmen, die KI-Agenten mit dem echten Internet verbinden, entscheidet inzwischen direkt, ob Protokolle vollständig geführt und maschinell schnell durchsuchbar sind, wie viel Geld und Zeit nach einem Vorfall nötig sind, um der Öffentlichkeit Rechenschaft abzulegen.

Der Generalstaatsanwalt von Kalifornien hat OpenAI diese Woche im Zusammenhang mit dieser Serie von Vorfällen vorgeladen. Ob Aufsichtsbehörden nach der Veröffentlichung der Tageskosten detailliertere Offenlegungen verlangen werden, etwa zum Umfang der Betroffenheit jeder einzelnen benachrichtigten Institution, ist derzeit noch nicht absehbar.

Quellen: Untersuchungsbericht von OpenAI, The Guardian, CocoLoop, Gizmodo, ithome.com; Angaben zu GPU-Anzahl, 50-Petabyte-Datenmenge und täglichen Durchschnittskosten laut OpenAI, Kosten pro GPU grob geschätzt von der Redaktion.