Microsoft AI veröffentlichte am 27. Juli MAI-Cyber-1-Flash und integrierte es in MDASH, ein Multi-Agenten-System für Erkennung und Behebung von Schwachstellen. Zusammen erreichten sie 95,95%, im Text gerundet 96%, auf CyberGym.
Die Aufgabenteilung ist der Punkt
Microsoft zufolge soll MAI-Cyber-1-Flash bis zu 90% der Aufgaben effizient übernehmen. Die schwersten 10% gehen an größere Modelle wie GPT-5.4. Gegenüber der bisherigen besten MDASH-Konfiguration nennt Microsoft 50% geringere Kosten.
Für Sicherheitsteams ist Scannen kein Demo-Moment. Codebasen, Abhängigkeiten und Angriffe ändern sich fortlaufend. Die Kosten pro wiederholtem Scan entscheiden, ob solche Systeme im Alltag tragfähig sind.
Überprüfbare Zahlen
Microsofts Grafik zeigt vier andere Modelle zwischen 83,2% und 85,6%, während MDASH mit MAI-Cyber-1-Flash bei 95,95% liegt. Help Net Security berichtete ebenfalls über Microsofts Aussage, Mythos, Gemini und GPT zu übertreffen, sowie über AI-Red-Team-Prüfung, adversariale Tests und externe Bewertung.
Der nächste Test
Project Perception soll am 3. August 2026 in die öffentliche Preview gehen. Es umfasst rollenbasierte Kontrollen, Mandantentrennung, Verschlüsselung, Auditierbarkeit und Sandbox-Ausführung ohne Internetzugang. Aussagekräftig werden Kundenfälle, externe Retests, Falsch-Positiv-Raten und der Weg von der Schwachstelle bis zur geprüften Behebung.
Quellen: Microsoft AI official release, Microsoft Security Blog, Help Net Security, CocoLoop; checked MAI-Cyber-1-Flash/MDASH scope, 95.95%/96% CyberGym score, 12-point lead over Mythos, 50% cost saving, 90%/10% task routing, 100+ agents, 100 trillion daily security signals, 1.6 million customers and Project Perception preview plan.