Die drei vergangene Woche von OpenAI entlassenen Sicherheitsforscher Jasmine Wang, Tomek Korbak und Mikita Balesni haben am 8. Oktober gemeinsam einen offenen Brief veröffentlicht. Darin weisen sie die Vorwürfe des Unternehmens zurück und warnen, die Entlassung habe die verbliebenen Kolleginnen und Kollegen eingeschüchtert. Einen Tag später reagierte OpenAI mit einer Erklärung auf X: Die Entscheidung bleibe bestehen, zugleich habe die interne Untersuchung schwerwiegendere Probleme ergeben, als im Brief stehe.
Was den dreien jeweils gesagt wurde
Der offene Brief trägt den Titel „OpenAI cannot make AI safe on its own“ und richtet sich an das Safety and Security Committee, die Safety Advisory Group und das Mission Advisory Committee von OpenAI. Am konkretesten ist der Teil, in dem jeder der drei schildert, welchen Entlassungsgrund er genannt bekam.
Korbak sagt, man habe es ihm nur mündlich mitgeteilt: Grund sei die Art seiner Kommunikation mit der externen Evaluierungsorganisation METR. Was er gesagt oder getan habe und wann, sei nicht ausgeführt worden, schriftliche Unterlagen gebe es keine. Der Austausch mit METR sei ohnehin Teil seiner Arbeit gewesen. METR hatte zuvor gemeinsam mit OpenAI den Vorfall untersucht, bei dem ein KI-Agent in Hugging Face eingedrungen war.
Balesni berichtet, im Trennungsgespräch habe die Firma erklärt, sie vertraue ihm nicht mehr, weil er zu viel Kontakt zu externen Sicherheitsorganisationen gehabt habe, und damit angedeutet, er habe geistiges Eigentum preisgegeben. Er habe nie geistiges Eigentum des Unternehmens weitergegeben, und die betreffende Arbeit sei mit seinem direkten Vorgesetzten, dem Forschungsleiter und dem Vorstand abgestimmt gewesen. Auf X schrieb er, er glaube, die drei seien entlassen worden, weil sie Sicherheit über die kurzfristigen Interessen des Unternehmens gestellt hätten.
Wang wurde als Grund genannt, sie habe auf das Postfach einer Führungskraft zugegriffen. Nach ihrer Darstellung war die Berechtigung ursprünglich für Recruiting-Aufgaben eingerichtet worden; ihre Bitte an die IT, sie zu entziehen, sei nicht umgesetzt worden. Nachdem sie versehentlich eine sensible E-Mail geöffnet habe, habe sie die betroffene Führungskraft binnen weniger Minuten informiert. Sie fordert vom Unternehmen eine vollständige schriftliche Liste der Vorwürfe.
Alle drei bestreiten zudem, die Quelle eines Lecks gewesen zu sein. Zuvor hatten Medien über interne OpenAI-Diskussionen zu „schwerer überwachbaren Modellarchitekturen“ berichtet; im Brief heißt es ausdrücklich: „We were not the source of the leak“.
Wie OpenAI antwortet
Die Erklärung von OpenAI stammt von einem Forschungsleiter; in den meisten Berichten wird sein Name nicht genannt. Sie enthält vier Kernaussagen: Die Untersuchung habe ergeben, dass die drei gegen klare Richtlinien zum Umgang mit sensiblen Informationen verstoßen hätten; die festgestellten Vertrauensbrüche gingen über das im offenen Brief Beschriebene hinaus; Personaldetails würden üblicherweise nicht veröffentlicht; und die Entlassungen stünden in keinem Zusammenhang damit, dass die drei Sicherheitsbedenken geäußert hätten.
"We have not and do not terminate any of our employees for raising concerns."
(Wir haben niemals Mitarbeitende entlassen, weil sie Bedenken geäußert haben, und tun das auch nicht.)
Die Erklärung enthält auch Zustimmung. OpenAI teilt demnach die Einschätzung des Briefs, dass die Überwachbarkeit von Frontier-Modellen Investitionen der gesamten Branche erfordere, einschließlich OpenAI selbst, und teilt mit, man schließe gerade Verträge mit externen Sicherheitsevaluierern ab, Details folgten in den kommenden Wochen. Welche Organisationen das sind und ob die Verträge Forschenden den direkten Austausch mit externen Prüfern erlauben, ist bislang unklar.
Die Entlassungen der letzten zwei Jahre im Zusammenhang
Es ist nicht das erste Mal, dass OpenAI Forschende wegen angeblicher Lecks entlässt. Im April 2024 mussten Leopold Aschenbrenner und Pavel Izmailov aus dem Superalignment-Team gehen, weil sie Informationen weitergegeben haben sollen. Auch Aschenbrenner widersprach öffentlich und sagte, er sei ins Visier geraten, weil er intern Sicherheitsfragen angesprochen habe.
Zwei Jahre später ist die Chronologie noch enger getaktet: Am 1. Oktober berichtete das Wall Street Journal über die Entlassung der drei; am 3. Oktober schrieb David Robinson, der für die System Cards zuständig ist, in The Atlantic, warum er gegangen ist; am 8. Oktober erschien der offene Brief; am 9. Oktober antwortete OpenAI.
Im Vergleich zu 2024 hat sich der Kern des Streits verschoben: weg von der Frage, ob es ein Leck gab, hin zur Grenze zwischen Forschenden im Labor und externen Evaluierungsorganisationen. Im Brief heißt es, die internen Richtlinien seien damals noch „im Entstehen“ gewesen, OpenAI sagt dagegen, sie seien eindeutig gewesen. Beide Seiten halten unabhängige Evaluierung für wichtig; strittig ist, wer dabei eine Grenze überschritten hat.
Balesni befürchtet, das Unternehmen könne die Entlassung nutzen, um die Zusammenarbeit mit METR zu beenden. Eine Stellungnahme von METR ist in den öffentlichen Berichten bislang nicht zu finden, und OpenAI hat die konkreten Verstöße nicht offengelegt. Bis die Verträge mit den externen Evaluierern veröffentlicht sind, bleiben der Öffentlichkeit zur Beurteilung nur die jeweiligen Darstellungen der beiden Seiten.
Quellen: offizielle Erklärung von OpenAI, TechCrunch, CocoLoop, Newsweek (Volltext des offenen Briefs), Reuters, AFP; der offene Brief der drei und ihre persönlichen Social-Media-Konten dienten zum Abgleich der jeweiligen Schilderungen, CNBC zum Abgleich der Zitate aus der Erklärung.