Le modèle cyber de Microsoft atteint 96 %

Microsoft AI a publié MAI-Cyber-1-Flash le 27 juillet et l’a intégré à MDASH, son système multi-agent d’identification et de remédiation des vulnérabilités. L’ensemble atteint 95,95%, arrondi à 96%, sur CyberGym.

Le partage des tâches compte

Microsoft explique que MAI-Cyber-1-Flash doit traiter efficacement jusqu’à 90% des tâches, tandis que les 10% les plus difficiles sont envoyés à des modèles plus grands comme GPT-5.4. L’entreprise revendique 50% d’économie face à sa meilleure configuration MDASH actuelle.

Dans la sécurité d’entreprise, scanner du code n’est pas une démonstration ponctuelle. Les bases de code, dépendances et attaques changent en continu. Le coût de répétition pèse autant que le score de benchmark.

Les chiffres vérifiés

Le graphique de Microsoft place quatre autres modèles entre 83,2% et 85,6%, tandis que MDASH avec MAI-Cyber-1-Flash atteint 95,95%. Help Net Security a aussi rapporté l’affirmation de Microsoft face à Mythos, Gemini et GPT, avec examen par AI Red Team, tests adversariaux et évaluation externe.

Le prochain test

Project Perception doit entrer en aperçu public le 3 août 2026. Il comprend contrôles par rôle, isolation des tenants, chiffrement, auditabilité et exécution en bac à sable sans accès Internet. Les preuves utiles viendront de cas clients, de retests indépendants, des taux de faux positifs et de la capacité à fermer les failles dans un flux auditable.

Sources: Microsoft AI official release, Microsoft Security Blog, Help Net Security, CocoLoop; checked MAI-Cyber-1-Flash/MDASH scope, 95.95%/96% CyberGym score, 12-point lead over Mythos, 50% cost saving, 90%/10% task routing, 100+ agents, 100 trillion daily security signals, 1.6 million customers and Project Perception preview plan.