Reasoning-Modelle als Hacker: 97 % Erfolgsquote beim Umgehen von KI-Sicherheitsvorkehrungen
Eine in Nature Communications veröffentlichte Studie der Universität Stuttgart und des ELLIS Alicante Instituts zeigt, dass große Reasoning-Modelle (LRM) autonom andere KI-Modelle angreifen und deren Sicherheitsvorkehrungen mit einer Gesamterfolgsquote von 97,14 % in 25.200 Tests umgehen können.