A Microsoft AI lançou o MAI-Cyber-1-Flash em 27 de julho e o integrou ao MDASH, um harness multiagente para identificar e corrigir vulnerabilidades. A combinação chegou a 95,95%, arredondado para 96%, no CyberGym.
O desenho de custos
Segundo a Microsoft, o modelo foi feito para lidar com até 90% das tarefas de forma eficiente, enquanto os 10% mais difíceis são enviados a modelos maiores, como o GPT-5.4. A empresa fala em economia de 50% frente à melhor configuração atual do MDASH.
Em segurança corporativa, varredura de código não é uma demonstração isolada. Código, dependências e ataques mudam sem parar. O custo de repetir a análise pesa tanto quanto o placar do benchmark.
O que foi confirmado
O gráfico da Microsoft coloca quatro outros modelos entre 83,2% e 85,6%, enquanto MDASH com MAI-Cyber-1-Flash aparece em 95,95%. A Help Net Security também relatou a alegação de superar Mythos, Gemini e GPT, além de revisão do AI Red Team, testes adversariais e avaliação externa.
O que observar
O Project Perception deve entrar em preview público em 3 de agosto de 2026. Ele inclui controles por função, isolamento de tenant, criptografia, auditabilidade e sandbox sem acesso à internet. O teste real virá de casos de clientes, retestes independentes, taxas de falso positivo e da capacidade de fechar falhas dentro do fluxo auditável da empresa.
Fontes: Microsoft AI official release, Microsoft Security Blog, Help Net Security, CocoLoop; checked MAI-Cyber-1-Flash/MDASH scope, 95.95%/96% CyberGym score, 12-point lead over Mythos, 50% cost saving, 90%/10% task routing, 100+ agents, 100 trillion daily security signals, 1.6 million customers and Project Perception preview plan.