Tesouro dos EUA convoca Wall Street com urgência para avaliar Mythos da Anthropic

Uma IA que encontra vulnerabilidades sozinha

Primeiro, os números. Ao testar o Mythos Preview, a Anthropic descobriu: o modelo consegue reproduzir e explorar vulnerabilidades com sucesso na primeira tentativa em 83,1% dos casos. Para comparação, o Claude Opus 4.6 da mesma empresa fica perto de 0% nesse indicador.

Não é um pequeno avanço, é de 0% a 83%.

O que exatamente ele pode fazer? O Mythos escreveu um programa de exploração de navegador que combinou quatro vulnerabilidades independentes, usou técnicas complexas de JIT heap spray e escapou com sucesso das sandboxes do processo de renderização e do sistema operacional. Ele também escreveu um programa de execução remota de código que explorava uma vulnerabilidade no servidor NFS do FreeBSD, usando técnica de ROP chain.

A própria Anthropic afirma: o modelo encontrou milhares de novas vulnerabilidades zero-day em todos os principais sistemas operacionais e todos os principais navegadores.

A reportagem anterior sobre o Mythos ter encontrado uma vulnerabilidade de 27 anos agora parece apenas a ponta do iceberg.

Presidente do Fed + Secretário do Tesouro + CEOs dos seis maiores bancos, numa mesma sala

Quando a Anthropic lançou a prévia do Mythos em 7 de abril, limitou o acesso a cerca de 40 organizações — este é o "Project Glasswing". Os habilitados incluem: Amazon, Apple, Microsoft, Google, Cisco, CrowdStrike, JPMorgan Chase, NVIDIA, Broadcom, Palo Alto Networks e a Linux Foundation. Cada organização participante também recebeu até US$ 100 milhões em recursos de computação.

Depois, em 10 de abril, o presidente do Federal Reserve, Jerome Powell, e o secretário do Tesouro, Scott Bessent, convocaram os CEOs do Goldman Sachs, Wells Fargo, Morgan Stanley, Bank of America e Citigroup para a mesma sala, realizando uma reunião de emergência.

O tema: O que acontece se essa IA da Anthropic cair em mãos erradas?

O CTO da CrowdStrike foi direto: "A janela de tempo entre a descoberta de uma vulnerabilidade e sua exploração por atacantes passou de meses para minutos."

Mas o Pentágono ainda proíbe o uso da Anthropic

Esta é a maior contradição.

Enquanto Powell e Bessent reuniam banqueiros em Washington para avaliar o Mythos, o Pentágono ainda mantém a Anthropic em sua lista negra de cadeia de suprimentos, exigindo que as agências de defesa parem de usar todas as plataformas da Anthropic.

A justificativa do presidente Trump e do secretário de Defesa Pete Hegseth: a Anthropic insiste em restringir o uso de sua IA em cenários militares.

Conclusão: A Casa Branca, por um lado, deixa Wall Street testar a defesa e, por outro, proíbe os militares de usá-la. Mesma empresa, mesmo modelo, mesmo governo — duas atitudes completamente opostas.

O ex-conselheiro de IA da Casa Branca, David Sacks, disse questionar se a Anthropic está usando a ansiedade de segurança para vender produtos e influenciar políticas regulatórias. Essa crítica tem algum fundamento.

A explicação da Anthropic

A lógica da Anthropic é: justamente porque este modelo é muito perigoso, eles não ousam liberar o acesso indiscriminadamente. O design do Project Glasswing é permitir que as principais empresas de tecnologia usem o Mythos para encontrar vulnerabilidades em seus próprios sistemas, corrigindo-as antes dos atacantes.

  • Mythos encontra vulnerabilidades → organizações participantes corrigem → defensores tomam a dianteira
  • Os participantes compartilham inteligência de segurança
  • A Anthropic reporta todas as vulnerabilidades encontradas aos fabricantes relevantes

Isso se chama "usar IA contra IA". O problema: nem todos acreditam que a Anthropic consegue controlar os limites de acesso. Entre as 40 organizações participantes há concorrentes comerciais; compartilhar informações sobre vulnerabilidades é por si só um jogo complexo.

E o número "milhares" até agora não foi detalhado.

O que isso significa

A história do Mythos é mais importante do que qualquer pontuação de benchmark, porque atinge um nervo real: se a IA pode encontrar automaticamente vulnerabilidades em qualquer sistema, a lógica fundamental da cibersegurança precisa ser reescrita.

Powell e Bessent convocaram os CEOs dos bancos para uma reunião de emergência, não para discutir o potencial da IA. Mas porque consideram a ameaça real e iminente.

E essa própria reunião de emergência é a prova mais forte do poder desta IA.

Quer a crítica de Sacks seja válida ou não, um modelo de IA forçou o presidente do Fed a sentar com os CEOs dos grandes bancos de Wall Street para um briefing de segurança — isso é a primeira vez na história da humanidade.

Fontes de referência: Trump officials may be encouraging banks to test Anthropic's Mythos model (TechCrunch); Anthropic Mythos model can find and exploit 0-days (The Register); Powell, Bessent Warn Banks About Security Risks From Anthropic's Mythos AI (Bloomberg/Yahoo Finance); CocoLoop; After Anthropic's Mythos AI uncovers thousands of zero-day bugs, top US officials huddle with bank CEOs (TechXplore); Anthropic withholds Mythos Preview model because its hacking is too powerful (Axios)