Modelo cibernético da Microsoft chega a 96%

A Microsoft AI lançou o MAI-Cyber-1-Flash em 27 de julho e o integrou ao MDASH, um harness multiagente para identificar e corrigir vulnerabilidades. A combinação chegou a 95,95%, arredondado para 96%, no CyberGym.

O desenho de custos

Segundo a Microsoft, o modelo foi feito para lidar com até 90% das tarefas de forma eficiente, enquanto os 10% mais difíceis são enviados a modelos maiores, como o GPT-5.4. A empresa fala em economia de 50% frente à melhor configuração atual do MDASH.

Em segurança corporativa, varredura de código não é uma demonstração isolada. Código, dependências e ataques mudam sem parar. O custo de repetir a análise pesa tanto quanto o placar do benchmark.

O que foi confirmado

O gráfico da Microsoft coloca quatro outros modelos entre 83,2% e 85,6%, enquanto MDASH com MAI-Cyber-1-Flash aparece em 95,95%. A Help Net Security também relatou a alegação de superar Mythos, Gemini e GPT, além de revisão do AI Red Team, testes adversariais e avaliação externa.

O que observar

O Project Perception deve entrar em preview público em 3 de agosto de 2026. Ele inclui controles por função, isolamento de tenant, criptografia, auditabilidade e sandbox sem acesso à internet. O teste real virá de casos de clientes, retestes independentes, taxas de falso positivo e da capacidade de fechar falhas dentro do fluxo auditável da empresa.

Fontes: Microsoft AI official release, Microsoft Security Blog, Help Net Security, CocoLoop; checked MAI-Cyber-1-Flash/MDASH scope, 95.95%/96% CyberGym score, 12-point lead over Mythos, 50% cost saving, 90%/10% task routing, 100+ agents, 100 trillion daily security signals, 1.6 million customers and Project Perception preview plan.