Anthropic cria IA capaz de desenterrar vulnerabilidade de 27 anos

A Anthropic fez ontem (7 de abril) algo bastante incomum: lançou um novo modelo, mas não o disponibilizou para o público em geral.

O modelo chama-se Claude Mythos. A própria avaliação interna da Anthropic afirma que ele supera largamente qualquer outro modelo de IA em capacidades de cibersegurança. E a decisão foi tomada: não será público, apenas um pequeno grupo de parceiros selecionados terá acesso para testes.

O projeto chama-se Project Glasswing.

Quem pode usar esta ferramenta?

A lista é impressionante: AWS, Apple, Nvidia, Google, Microsoft, Cisco, CrowdStrike, JPMorgan Chase… cerca de 10 gigantes da tecnologia, além de outras 40 organizações responsáveis pela manutenção de infraestruturas críticas.

No total, cerca de 50 organizações. A internet usada por milhares de milhões de pessoas em todo o mundo dependerá destas 50 organizações para aplicar correções com o Mythos.

A Anthropic também ofereceu 100 milhões de dólares em créditos de uso do modelo para estes parceiros, além de doar diretamente 4 milhões de dólares para a comunidade de segurança de código aberto.

Que vulnerabilidades o Mythos consegue realmente encontrar?

Nas últimas semanas, a Anthropic utilizou o Mythos Preview para realizar uma série de análises:

  • Milhares de vulnerabilidades zero-day, abrangendo todos os principais sistemas operativos e navegadores
  • Uma vulnerabilidade de 27 anos no OpenBSD que pode causar uma falha remota do sistema
  • Uma falha de 16 anos no FFmpeg que resistiu a milhões de testes automatizados sem ser detetada
  • Múltiplas vulnerabilidades no kernel do Linux que permitem escalada de privilégios

27 anos. Não se trata de encontrar bugs, trata-se de uma escavação arqueológica.

A falha do FFmpeg é ainda mais elucidativa: milhões de análises automatizadas não a detetaram, uma IA descobriu-a em poucas semanas. As ferramentas de segurança tradicionais deveriam preocupar-se com a sua própria posição.

Porque não é tornado público?

A Anthropic alertou em privado altos funcionários governamentais: o Mythos torna os ciberataques em grande escala impulsionados por IA significativamente mais prováveis este ano.

Há um mês, um rascunho interno acidentalmente exposto já afirmava: o Mythos supera atualmente qualquer outro modelo de IA em capacidades de cibersegurança. Esta frase não era um exagero, mas sim uma expressão séria de preocupação.

Defesa e ataque usam as mesmas capacidades. O Mythos pode ajudá-lo a encontrar vulnerabilidades e corrigi-las, mas também pode ajudar hackers a encontrar vulnerabilidades e invadir sistemas. A abordagem da Anthropic é: dar à defesa uma vantagem de antecipação – permitindo que as grandes empresas e os operadores de infraestruturas críticas tapem os buracos antes dos atacantes.

Esta estratégia tem problemas?

Esta é uma aposta bastante delicada.

O aspeto convincente: se o Mythos for realmente capaz de descobrir em massa vulnerabilidades que permanecem por corrigir há décadas, isto é, de facto, inovador no plano defensivo. As ferramentas de segurança existentes claramente não o conseguem fazer, caso contrário a vulnerabilidade de 27 anos do OpenBSD já teria sido detetada.

Mas quanto tempo pode durar o modelo fechado de 50 organizações? Os insiders dos parceiros poderão causar fugas? Outros laboratórios poderão replicar capacidades semelhantes?

A questão mais fundamental é: a Anthropic já o construiu. Quer seja público ou não, a capacidade já existe. Em vez de discutir se deve ou não ser tornado público, a pergunta é: antes de os concorrentes terem capacidades semelhantes, quantas falhas conseguirão estas 50 organizações tapar?

O Project Glasswing não é tanto uma gestão de risco, mas sim uma corrida contra o tempo.

Fontes de referência: Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative (TechCrunch); CocoLoop, Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses (Fortune); Project Glasswing: Securing critical software for the AI era (anthropic.com); Project Glasswing: Anthropic announces big tech consortium to test Claude Mythos (IT Pro)