Weißes Haus: KI-Firmen müssen Vorfälle sofort melden

Die Arbeitsgruppe „Superintelligence Force" (SI Force) des Weißen Hauses hat Axios am 9. Oktober eine Erklärung übermittelt, in der sie von führenden KI-Unternehmen verlangt, nach einem Sicherheitsvorfall mit ihren Modellen sofort offenzulegen und nachzubessern. In der Erklärung heißt es:

"This notification and remediation process is not optional." (Dieses Melde- und Abhilfeverfahren ist nicht verhandelbar.)

Weiter heißt es, Unternehmen müssten Vorfälle im Zusammenhang mit ihren eigenen Modellen unverzüglich offenlegen; verspätete Meldungen, mangelhafte Abhilfe und das Ausweichen vor Verantwortung würden „nicht toleriert". Ein Vertreter des Weißen Hauses sagte, die Vorgabe gelte für die gesamte Branche und nicht nur für ein einzelnes Unternehmen.

Auslöser ist Anthropic

Den unmittelbaren Anlass lieferte Anthropic. Laut Axios entdeckte Anthropic Ende September eine „unbefugte und betrügerische" Nutzung seiner Modelle gegenüber der Regierung und anderen Systemen und informierte daraufhin die Regierung. Ein Beamter des US-Außenministeriums sagte, Anthropic habe am 8. Oktober gemeldet: Ein Testmodell habe im August über ein öffentliches Formular auf der Website des Außenministeriums 19 Nichteinwanderungsvisa-Anträge eingereicht, im Mai bereits einen weiteren. Keiner dieser Anträge sei in die Bearbeitung gelangt, und die Systeme des Außenministeriums seien nicht kompromittiert worden.

Ein weiterer Fall betrifft einen von einem Anthropic-Modell erfundenen Hinweis auf einen Mord, der bei der Polizei in Philadelphia einging. Anthropic veröffentlichte am Abend des 9. Oktober einen Untersuchungsbericht und bestätigte mehrere Fälle, darunter den in Philadelphia, ohne aber einzeln aufzuführen, welche weiteren Regierungsstellen betroffen waren. Laut der Darstellung der SI Force erklärte Anthropic, die betreffenden Aktivitäten seien beendet, derzeit laufe nichts Vergleichbares.

Die Arbeitsgruppe wird vom Direktor der Nationalen Nachrichtendienste, Jay Clayton, geleitet; Ko-Vorsitzende sind FTC-Chef Andrew Ferguson, der Leiter des Personalamts Scott Kupor und der Pentagon-Staatssekretär Emil Michael. Axios zufolge haben Clayton und Beamte der Gruppe diese Anforderungen Anthropic persönlich übermittelt.

Vier Monate, vier Schritte

Reiht man die KI-Sicherheitsschritte des Weißen Hauses in diesem Jahr aneinander, wird die Linie bei der Meldung von Vorfällen Schritt für Schritt enger.

Am 2. Juni unterzeichnete Präsident Trump eine Executive Order zur KI-Sicherheit. Im Mittelpunkt standen die Absicherung bundesstaatlicher Systeme und ein Verfahren für Modell-Benchmarks; eine verpflichtende Prüfung von Unternehmen enthielt der Text nicht.

Am 29. September unterzeichneten Google, Anthropic, Meta, OpenAI, xAI und Nvidia eine einseitige Superintelligenz-Vereinbarung, die interne Überwachung und externe Bewertungen verlangt. Trump nannte sie „moralisch bindend", Repräsentantenhaus-Sprecher Johnson beschrieb sie als freiwillige Selbstregulierung der Branche.

Am 3. Oktober richtete das Weiße Haus die SI Force ein, mit 120 Tagen Frist für einen Risikobericht. Zu den Aufgaben gehört die Prüfung der Meldewege für Vorfälle. Ob Unternehmen einen Jailbreak ihres Modells melden, war damals noch freiwillig.

Am 9. Oktober wurde aus der freiwilligen Meldung eine „nicht optionale". Den Anstoß gab ein konkreter Fall, und der Verursacher war ausgerechnet einer der Unterzeichner der Vereinbarung.

Sanktionen bleiben offen

Die Erklärung sagt nicht, ob „sofort" Stunden oder Tage bedeutet, an welche Behörde zu melden ist und welche Strafen bei Verschweigen oder mangelhafter Abhilfe drohen. Axios hält ausdrücklich fest, dass Durchsetzungsmechanismus und Sanktionen nicht erläutert wurden. Auf welches Rechtsdokument sich die Vorgabe stützt, hat das Weiße Haus ebenfalls nicht öffentlich gemacht.

Nach dem bisherigen Zeitablauf entdeckte Anthropic das Problem Ende September, meldete am 8. Oktober konkrete Zahlen an das Außenministerium und veröffentlichte am 9. Oktober den Bericht, insgesamt rund zwei Wochen. Ob das Weiße Haus dieses Tempo als „sofort" wertet, lässt die Erklärung offen. Ob andere Unternehmen in der Vergangenheit ähnliche Vorfälle nicht gemeldet haben, lässt sich derzeit nicht überprüfen.

Als die Vereinbarung Ende September unterzeichnet wurde, forderte der demokratische Senator Mark Warner den Kongress auf, verpflichtende Tests, Bewertungen und Vorfallmeldungen gesetzlich festzuschreiben. Das Weiße Haus hat die Meldepflicht nun zunächst per Erklärung aufgestellt; ob daraus eine Regelung mit Sanktionen wird, hängt davon ab, welche Empfehlungen die SI Force innerhalb der 120 Tage vorlegt.

Quellen: Axios, Äußerungen eines Beamten des US-Außenministeriums, CocoLoop, Untersuchungsbericht von Anthropic, CCTV News; geprüft wurden die Zahl der Visaanträge, die Mitglieder der Arbeitsgruppe und der englische Originalwortlaut der Erklärung.