Anthropic hizo ayer (7 de abril) algo muy inusual: lanzó un nuevo modelo, pero no lo puso a disposición del público en general.
Este modelo se llama Claude Mythos. La propia evaluación interna de Anthropic afirma que supera con creces a cualquier otro modelo de IA en capacidades de ciberseguridad. Y tomaron la decisión: no será público, solo un pequeño grupo de socios seleccionados podrá probarlo.
Este proyecto se llama Project Glasswing.
¿Quién puede usar esto?
La lista es impresionante: AWS, Apple, Nvidia, Google, Microsoft, Cisco, CrowdStrike, JPMorgan Chase… unos 10 gigantes tecnológicos, más otras 40 organizaciones responsables del mantenimiento de infraestructuras críticas.
En total, unas 50 organizaciones. Internet, utilizada por miles de millones de personas en todo el mundo, dependerá de estas 50 organizaciones para aplicar parches con Mythos.
Anthropic también ofreció 100 millones de dólares en créditos de uso del modelo para estos socios, además de donar directamente 4 millones de dólares a la comunidad de seguridad de código abierto.
¿Qué vulnerabilidades puede encontrar realmente Mythos?
En las últimas semanas, Anthropic ha utilizado Mythos Preview para realizar una serie de análisis:
- Miles de vulnerabilidades de día cero, que cubren todos los sistemas operativos y navegadores principales
- Una vulnerabilidad de 27 años en OpenBSD que puede provocar un fallo remoto del sistema
- Un fallo de 16 años en FFmpeg que había resistido millones de pruebas automatizadas sin ser detectado
- Múltiples vulnerabilidades en el kernel de Linux que permiten la escalada de privilegios
27 años. No es encontrar errores, es una excavación arqueológica.
El fallo de FFmpeg es aún más revelador: millones de análisis automatizados no lo detectaron, una IA lo descubrió en pocas semanas. Las herramientas de seguridad tradicionales deberían preocuparse por su propia posición.
¿Por qué no se hace público?
Anthropic ha advertido en privado a altos funcionarios gubernamentales: Mythos hace que los ciberataques a gran escala impulsados por IA sean significativamente más probables este año.
Hace un mes, un borrador interno expuesto accidentalmente ya decía: Mythos supera actualmente a cualquier otro modelo de IA en capacidades de ciberseguridad. Esta frase no era un alarde, sino una expresión seria de preocupación.
La defensa y el ataque utilizan las mismas capacidades. Mythos puede ayudarle a encontrar vulnerabilidades y corregirlas, pero también puede ayudar a los hackers a encontrar vulnerabilidades e infiltrarse. El enfoque de Anthropic es: dar a la defensa una ventaja de anticipación – permitiendo que las grandes empresas y los operadores de infraestructuras críticas tapen los agujeros antes que los atacantes.
¿Tiene problemas esta estrategia?
Esta es una apuesta bastante delicada.
Lo convincente: si Mythos es realmente capaz de descubrir en masa vulnerabilidades que llevan décadas sin parchear, esto es, de hecho, innovador en el plano defensivo. Las herramientas de seguridad existentes claramente no pueden hacerlo, de lo contrario la vulnerabilidad de 27 años de OpenBSD ya habría sido detectada.
Pero, ¿cuánto tiempo puede durar el modelo cerrado de 50 organizaciones? ¿Podrían los empleados de los socios causar filtraciones? ¿Podrían otros laboratorios replicar capacidades similares?
La cuestión más fundamental es: Anthropic ya lo ha construido. Ya sea público o no, la capacidad ya existe. En lugar de discutir si debe hacerse público o no, la pregunta es: antes de que los competidores tengan capacidades similares, ¿cuántos agujeros podrán tapar estas 50 organizaciones?
Project Glasswing no es tanto una gestión de riesgos, sino una carrera contra el tiempo.
Fuentes de referencia: Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative (TechCrunch); CocoLoop, Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses (Fortune); Project Glasswing: Securing critical software for the AI era (anthropic.com); Project Glasswing: Anthropic announces big tech consortium to test Claude Mythos (IT Pro)