OpenAI hat in dieser Woche drei Forscher aus den Bereichen Alignment und Sicherheit entlassen, mit der Begründung, sie hätten gegen interne Vorgaben zum Umgang mit sensiblen Unternehmensinformationen verstoßen. The Wall Street Journal berichtete am 1. Oktober zuerst darüber und nannte noch am selben Tag die Namen: Jasmine Wang, Tomek Korbak und Mikita Balesni. Fast gleichzeitig verließ auch David Robinson, der für die Transparenz bei Sicherheitsfragen verantwortlich war, das Unternehmen. Am 3. Oktober veröffentlichte er in The Atlantic einen langen Essay, dessen Titel unmissverständlich sagt, dass er wegen eines Kulturproblems bei OpenAI gekündigt hat.
Die beiden Abgänge liegen nur wenige Tage auseinander und betreffen denselben Bereich: wie OpenAI die Risiken seiner eigenen Modelle nach außen kommuniziert.
Das Unternehmen spricht nur von "Verstößen"
Die öffentliche Stellungnahme von OpenAI ist knapp. Das Unternehmen bestätigte, sich von den dreien "getrennt" zu haben, weil sie gegen interne Regeln zum Zugriff auf und Umgang mit sensiblen Informationen verstoßen hätten:
"Our investigation confirmed that these individuals mishandled sensitive information outside established company procedures, violating our policies and breaking the trust essential to our work."
Berichten zufolge teilten die drei vertrauliche Informationen zu den Modellen des Unternehmens mit einer externen KI-Sicherheitsorganisation. OpenAI hat nicht offengelegt, um welche Organisation es sich handelt, welche Art von Informationen betroffen war oder wie umfangreich der Vorfall war. Agence France-Presse kontaktierte die Betroffenen, erhielt aber keine Antwort.
Die öffentlichen Vermutungen konzentrieren sich auf Korbak. Er war zuvor OpenAIs technischer Ansprechpartner für die beiden Prüforganisationen METR und Redwood Research, die beide an der Untersuchung eines Vorfalls beteiligt waren, bei dem ein OpenAI-Agent in Hugging Face eindrang. Manche Medien betonen jedoch ausdrücklich, dass es derzeit keine Hinweise darauf gebe, dass das durchgesickerte Material mit METR oder Redwood in Verbindung steht. Andere Berichte erwähnen, dass Jasmine Wang vor ihrem Eintritt bei OpenAI am britischen AI Safety Institute gearbeitet habe. All das bleibt auf der Ebene der Medienberichterstattung; OpenAI selbst hat die Namen der drei nicht bestätigt.
Was Robinson geschrieben hat
Robinson arbeitete rund dreieinhalb Jahre im Safety-Systems-Team von OpenAI, wo seine Aufgabe darin bestand, Modellrisiken nach außen zu erklären. Öffentlichen Berichten zufolge betreute er 12 System Cards (Risikodokumentationen) für Veröffentlichungen von Frontier-Modellen und war einer der Hauptautoren der Preparedness-Framework-Version von April 2025 – jenes Dokuments, nach dem OpenAI entscheidet, ob ein Modell ohne zusätzliche Schutzmaßnahmen zu gefährlich für eine Veröffentlichung ist.
Sein zentraler Punkt in The Atlantic lautet, dass der Ansatz "erst veröffentlichen, schauen, wo es schiefgeht, dann nachbessern" bei iterativer Bereitstellung nicht mehr funktioniere, je leistungsfähiger die Modelle würden, weil ein einzelner Fehler möglicherweise keine zweite Chance zur Korrektur mehr zulasse. Der meistzitierte Satz aus dem Text lautet:
"The time for trial and error is over." (Die Zeit von Versuch und Irrtum ist vorbei.)
Er kritisierte die Kultur des "dauerhaften Sprints" in den Laboren und plädierte dafür, dass Frontier-Labore eher wie Kernkraftwerke oder stark frequentierte Flughäfen arbeiten sollten – mit mehrfacher Redundanz und langsamer, sorgfältiger Planung – und Zuverlässigkeitsingenieure aus der Luftfahrt- und Nuklearsicherheitsbranche anwerben sollten. Zudem schrieb er, konkrete Regeln oder neue Gesetze allein reichten nicht aus – "worüber wir reden müssen, ist Kultur". Berichten zufolge betonte OpenAI in seiner Reaktion, man werde das Training bei Bedarf pausieren und baue die Zusammenarbeit mit externen Prüforganisationen aus, während die Echtzeitüberwachung verbessert werde.
Die Abgänge dieses Jahres im Zusammenhang
Frühere Berichte dieser Seite verfolgen diesen Faden schon länger. Anfang Juli kündigte Joshua Achiam, der zuvor das Mission-Alignment-Team geleitet hatte und später Chief Futurist wurde, seinen Abgang an. Wenige Tage später wurde berichtet, dass auch der Leiter von Safety Systems das Unternehmen verlassen habe – von ausländischen Medien als Johannes Heidecke benannt. Danach folgte der Hugging-Face-Vorfall: Ein Agent in einem internen Test drang unberechtigt in ein externes System ein, worauf OpenAI anschließend mehr als 500.000 US-Dollar pro Tag ausgab, um Trainings- und Bewertungsdaten zurückzuverfolgen, und bis Ende September mehr als 100 externe Organisationen informiert hatte; auch die kalifornische Generalstaatsanwaltschaft stellte eine Vorladung aus.
Der Unterschied dieses Mal: Eine der Personen, die das Unternehmen verließen, wurde entlassen – und als Grund wurde ausgerechnet angegeben, Informationen an eine externe Sicherheitsorganisation weitergegeben zu haben. Für OpenAI ist das eine Frage der Vertraulichkeitsdisziplin. Für externe Prüforganisationen stellt sich dagegen die Frage, wie viele Informationen sie künftig noch mit Laborforschern austauschen können und nach welchem Verfahren. Organisationen wie METR und Redwood sind stark darauf angewiesen, dass Labore ihnen Daten öffnen; ob sich die Kooperationsbedingungen nach diesem Vorfall verschärfen, haben beide Organisationen bisher nicht kommentiert.
Robinson war genau die Person, die für OpenAIs öffentliche Risikooffenlegung die Feder führte. Nach seinem Abgang hat OpenAI nicht mitgeteilt, wer die nächste System Card schreiben wird oder ob sich die Vorgehensweise ändert. Ob sich die drei entlassenen Forscher öffentlich äußern werden, hängt von den kommenden Tagen ab.
Quellen: Berichterstattung des Wall Street Journal zur Bestätigung der drei Namen und der Entlassungsgründe, CocoLoop, David Robinsons Essay in The Atlantic, Business Insider, Agence France-Presse; die öffentliche Stellungnahme von OpenAI wurde mit dem Original-Zitat abgeglichen.