El modelo ciber de Microsoft llega al 96%

Microsoft AI presentó MAI-Cyber-1-Flash el 27 de julio y lo integró en MDASH, su sistema multiagente para identificar y remediar vulnerabilidades. La combinación alcanzó 95,95%, redondeado a 96%, en CyberGym.

La división de trabajo importa

Microsoft afirma que MAI-Cyber-1-Flash puede gestionar hasta el 90% de las tareas de forma eficiente, mientras que el 10% más difícil se envía a modelos mayores como GPT-5.4. La compañía habla de un ahorro del 50% frente a su mejor configuración actual de MDASH.

En seguridad empresarial, el escaneo no es una demo puntual. El código, las dependencias y los ataques cambian continuamente. Por eso el coste de repetir análisis pesa tanto como el resultado de benchmark.

Números verificables

El gráfico de Microsoft sitúa a otros cuatro modelos entre 83,2% y 85,6%, mientras MDASH con MAI-Cyber-1-Flash aparece en 95,95%. Help Net Security también reportó la afirmación de Microsoft sobre Mythos, Gemini y GPT, junto con revisión de AI Red Team, pruebas adversariales y evaluación externa.

La prueba siguiente

Project Perception entrará en vista previa pública el 3 de agosto de 2026. Incluye controles por rol, aislamiento de inquilinos, cifrado, auditabilidad y ejecución en sandbox sin internet. La verificación útil será ver clientes reales, retests independientes, tasas de falsos positivos y si el sistema puede cerrar fallos dentro de flujos auditables.

Fuentes: Microsoft AI official release, Microsoft Security Blog, Help Net Security, CocoLoop; checked MAI-Cyber-1-Flash/MDASH scope, 95.95%/96% CyberGym score, 12-point lead over Mythos, 50% cost saving, 90%/10% task routing, 100+ agents, 100 trillion daily security signals, 1.6 million customers and Project Perception preview plan.