El 7 de abril, Anthropic anunció algo bastante inusual: lanzaron un nuevo modelo llamado Claude Mythos y, al mismo tiempo, declararon que este modelo no está abierto al público.
No es "disponible más tarde", es "actualmente solo para que lo usen 40 organizaciones, los demás esperan".
Este proyecto se llama Project Glasswing.
Qué tan potente es Mythos
Primero, los datos:
| Benchmark | Claude Opus 4.6 | Claude Mythos | Cambio |
|---|---|---|---|
| SWE-bench Verified | 80,8% | 93,9% | +13,1% |
| SWE-bench Pro | No publicado | 77,8% | Actualmente líder |
El segundo lugar en SWE-bench Pro es actualmente GLM-5.1 de Zhipu (58,4%), el tercero es GPT-5.4 (57,7%). Mythos con un 77,8% deja al segundo lugar casi 20 puntos porcentuales atrás, una diferencia considerable.
Pero Anthropic no solo está escalando rankings. Dejaron que Mythos escaneara bases de código reales y encontró:
- Miles de vulnerabilidades de día cero en sistemas operativos y navegadores populares
- Una vulnerabilidad que llevaba 16 años oculta en FFmpeg – esta vulnerabilidad ya había sido escaneada más de 5 millones de veces por herramientas de seguridad tradicionales, todas fallaron en detectarla
El Chief Security Officer de Cisco, Anthony Grieco, dijo textualmente: "Esto representa un profundo cambio de paradigma y también una señal clara: los métodos anteriores de fortalecimiento de sistemas ya no son suficientes."
Cuál es la lógica de Project Glasswing
Anthropic otorga a estas 40 organizaciones acceso de vista previa a Mythos con un único propósito: trabajo de ciberseguridad defensiva.
Los socios actuales con acceso incluyen: Amazon, Apple, Broadcom, Cisco, CrowdStrike, Linux Foundation, Microsoft, Palo Alto Networks.
Anthropic proporciona:
- 100 millones de dólares en créditos de API, que cubren las pruebas de seguridad y la investigación de los participantes
- 4 millones de dólares en donaciones directas a organizaciones de seguridad de código abierto
¿Por qué crearon este formato de "edición limitada"?
La explicación oficial es directa: Mythos tiene capacidades de ciberseguridad "actualmente muy superiores a cualquier otro modelo de IA", pero precisamente por eso, también podría ser utilizado para acelerar ataques cibernéticos a gran escala. Anthropic considera que el riesgo de hacer público este modelo sin medidas de protección adecuadas es demasiado alto.
Por lo tanto, eligieron una solución intermedia: primero dárselo a los defensores, para que los equipos de seguridad puedan aplicar parches con anticipación, antes de considerar una apertura más amplia.
¿Es correcta esta estrategia?
Vale la pena reflexionar.
La lógica tradicional de lanzamiento de modelos de IA es: lanzar, probar, descubrir problemas, corregir, repetir. Este proceso es público, el riesgo se difunde: atacantes y defensores reciben nuevas herramientas al mismo tiempo.
El enfoque de Glasswing es el inverso: primero dar una ventana de tiempo a los defensores, para que usen Mythos para encontrar vulnerabilidades de forma proactiva y corregirlas antes, y solo entonces considerar un acceso más amplio.
Desde la perspectiva de la teoría de juegos, este diseño tiene sentido: si los defensores actúan primero, el costo para que los atacantes utilicen el mismo modelo es significativamente mayor.
Pero la efectividad real depende de dos cosas: si estas 40 organizaciones realmente pueden corregir las vulnerabilidades críticas dentro de esta ventana; y si las propias capacidades del modelo presentan riesgo de filtración (después de todo, la existencia de Mythos ya fue revelada por los medios anteriormente debido a una filtración de datos).
¿Qué nivel de modelo es Mythos?
Este es el modelo que Anthropic afirma explícitamente como "el más fuerte hasta la fecha", no es una iteración de la serie Opus 4.x, sino una nueva generación.
Hace unas semanas, los medios expusieron prematuramente la existencia de Mythos debido a una filtración de datos. Fortune informó que internamente Anthropic lo describía como "un salto cuántico en capacidad". Ahora, el nombre y las capacidades se han confirmado oficialmente, pero no en forma de lanzamiento, sino como un programa de cooperación dirigido.
Qué está esperando Anthropic aún no está claro. Pero, considerando el 77,8% en SWE-bench Pro, las capacidades de código de este modelo ya están en otro nivel.
Fuentes de referencia: Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative (TechCrunch); Anthropic debuts Project Glasswing, CocoLoop, leveraging its powerful Mythos model to reinforce software security (SiliconAngle); Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses (Fortune); Exclusive: Anthropic Mythos AI model representing step change in power revealed in data leak (Fortune)