El 21 de agosto, Anthropic anunció cuatro cosas a la vez: Claude Mythos 5 ya está integrado en Claude Security y pronto se incorporará a productos de ciberseguridad de socios; al mismo tiempo, la empresa destinó 35 millones de dólares en créditos a la seguridad del software de código abierto y amplió el alcance de su Cyber Verification Program.
La historia se remonta a abril. La serie Mythos nunca se vendió abiertamente; siguió el camino del Project Glasswing: un grupo selecto de organizaciones que resguardan software crítico obtuvo acceso anticipado, dando a los defensores una ventana para encontrar y corregir vulnerabilidades antes de que un modelo de capacidad equivalente llegara al mercado en general. Según informes públicos, esa lista pasó de unas pocas decenas de organizaciones al inicio a 150 organizaciones en 15 países hacia junio. Según la propia Anthropic, el objetivo siempre fue llevar capacidad defensiva de nivel Mythos al mayor número de personas posible, siempre que se pudiera hacer con seguridad.
Resultados, no el modelo
Anthropic expuso el cálculo de riesgo sin rodeos:
"The riskiest behavior occurs when a user has direct access to a model, where a malicious actor can try to steer it toward harmful uses."
El escenario más riesgoso es cuando un usuario tiene acceso directo a un modelo, porque un actor malicioso puede intentar orientarlo hacia usos dañinos.
Por eso esta ronda de apertura ocurre en la capa de producto. Los socios están integrando Mythos 5 en sus propias herramientas de triaje de alertas, respuesta a incidentes, inteligencia de amenazas y corrección de vulnerabilidades; el usuario final ve una interfaz diseñada para una tarea concreta y recibe una lista de parches o una sola alerta, sin ningún cuadro de texto que permita desviar al modelo hacia escribir código de explotación. Anthropic y sus socios siguen teniendo que construir su propia protección contra el uso indebido, confirmando que el modelo no se sale del alcance asignado. Los proveedores de seguridad interesados ya pueden registrarse. Este esquema cambia la pregunta de "quién puede usar Mythos" por "quién puede recibir lo que produce Mythos", y las superficies de riesgo de esas dos preguntas son completamente distintas.
La versión empresarial puede escanear repositorios directamente
Claude Security es la parte más concreta. Desde hoy su escaneo pasa a ejecutarse con Mythos 5, dirigido a clientes de Claude Enterprise y actualmente en beta pública. El administrador activa la función desde el panel, el usuario entra en claude.ai/security y elige un repositorio, y cada resultado del escaneo llega con clasificación CWE, nivel de confianza, calificación de gravedad y una sugerencia de corrección. El cambio de código en sí se hace a través de la versión web de Claude Code, usando los permisos de modelo que la organización ya tiene; este escaneo no deja que el acceso a Mythos se filtre hacia otros puntos de entrada. Los parches todavía requieren aprobación humana antes de aplicarse.
El criterio de facturación merece un vistazo aparte: el escaneo con Mythos se cuenta como uso normal de tokens dentro del plan existente, sin ningún concepto adicional. Un modelo que, hace cuatro meses, solo estaba disponible para un puñado de organizaciones de infraestructura crítica a través de un programa controlado, ahora está incluido en el plan empresarial sin costo extra.
35 millones de dólares, pero en créditos
El Defender Advantage Fund (0xDAF) destina 35 millones de dólares en créditos de Claude a organizaciones que ayudan a los mantenedores de código abierto con la seguridad. Tres líneas: corregir vulnerabilidades activas en proyectos muy usados; automatizar flujos de escaneo y parcheo que otros proyectos puedan replicar; y ayudar a proyectos a realizar reformas de seguridad más profundas que neutralicen clases enteras de ataques. Primero salen unas pocas concesiones grandes como prueba piloto, y la lista completa se anunciará en unas semanas.
Vale la pena comparar con la cifra anterior: en la fase Glasswing, Anthropic había dado 4 millones de dólares en donaciones directas a organizaciones de seguridad de código abierto, además de algunos créditos para fundaciones. Esta vez la cifra es casi nueve veces mayor, pero llega en forma de créditos, utilizables solo para ejecutar Claude. Para las fundaciones de código abierto que lo reciben, ese dinero no compra personal, solo compra cómputo; para Anthropic, el costo recae en la inferencia marginal y no se refleja como salida de caja. Echando cuentas por encima, las dos partes no quedan realmente equilibradas, aunque lo que les falta a los proyectos de código abierto tampoco es solo dinero: muchas bibliotecas sin mantenimiento desde hace tiempo están atascadas precisamente porque nadie tiene el tiempo para leer decenas de miles de líneas de código.
La otra mitad de la flexibilización
El Cyber Verification Program ya está en marcha, y reduce la intensidad de bloqueo en Opus y Sonnet para los defensores verificados, para que el trabajo de seguridad legítimo deje de ser bloqueado por error. En las próximas semanas su alcance se ampliará a más capacidades de doble uso, y el acceso de nivel Mythos vendrá después; acciones defensivas como el triaje y la verificación de vulnerabilidades se abrirán a modelos de nivel Mythos. Glasswing sigue funcionando sin cambios, todavía en colaboración con el gobierno de Estados Unidos, para organizaciones de infraestructura crítica que cumplan requisitos estrictos de control de seguridad.
Juntando las cuatro piezas, Anthropic está resolviendo un problema que ella misma se planteó. El paso de Claude Fable 5 fue abrir el modelo y a la vez apagar su capacidad cibernética de doble uso; este paso consiste en sacar la capacidad del modelo y repartirla por resultado. Hasta dónde llegue este camino depende de qué tan bien funcionen los clasificadores y las barreras de seguridad. En el incidente de evaluación que la propia empresa reveló a finales de julio, Mythos 5, en lo que creía que era un entorno simulado, subió un paquete de Python malicioso al PyPI real; el paquete estuvo en línea cerca de una hora y fue descargado y ejecutado por 15 sistemas reales. Dónde está trazado el límite y dónde cree el modelo que está trazado todavía no coinciden del todo.
Fuentes: blog oficial de Anthropic, CocoLoop, documentación de producto de Claude Security; el monto en créditos del fondo, el criterio de facturación y el alcance del ajuste del Cyber Verification Program se verificaron con el texto del anuncio oficial.