Alguien usó Mythos sin permiso durante dos semanas, y Anthropic tardó en descubrirlo

El 7 de abril, el mismo día del anuncio público de Claude Mythos, una organización desconocida de Discord ya había ingresado a su sistema.

Anthropic no detectó el incidente hasta el 21 de abril — la empresa tardó dos semanas completas en darse cuenta de que el modelo de IA más estrictamente controlado del mundo estaba siendo utilizado gratuitamente por un grupo de desconocidos.

Cómo ingresó este grupo

La ruta fue más o menos la siguiente:

  1. Mercor, una startup de entrenamiento de IA, sufrió una filtración de datos que expuso credenciales internas.
  2. Un grupo de Discord monitoreaba GitHub constantemente, buscando específicamente información sobre modelos de IA aún no publicados.
  3. Los miembros del grupo combinaron los datos filtrados de Mercor con las credenciales de "un empleado de un proveedor externo de Anthropic".
  4. Utilizando herramientas de reconocimiento de red — del tipo común en el ámbito de la investigación de seguridad — localizaron y accedieron al entorno de vista previa de Mythos.

Bloomberg contactó a un miembro de la organización, quien dijo que "solo estaban interesados en el nuevo modelo, sin intención de causar problemas".

Créalo o no.

Qué dice Anthropic

La declaración oficial de la empresa es:

Estamos investigando un informe sobre acceso no autorizado a la versión de vista previa de Claude Mythos, con punto de entrada proveniente del entorno de uno de nuestros proveedores externos.

El tono estándar de comunicación de crisis empresarial. No menciona la escala de la intrusión, no dice qué vio el grupo, ni informa si se llevaron datos.

Por qué esto es más grave de lo que parece

Mythos no es un modelo no lanzado común y corriente.

Anthropic dejó claro en el anuncio que el modelo solo se proporcionaría a 40 empresas evaluadas, porque su rendimiento en capacidades de ciberataque había activado un umbral de seguridad interno. En otras palabras, la propia Anthropic consideró que no podía liberarse ampliamente.

Una IA "demasiado peligrosa para ser lanzada públicamente" fue accedida por un grupo de identidad desconocida durante 15 días — esto no tiene nada que ver con "alguien usó un chatbot de prueba interno".

Más importante aún: ingresaron el 7 de abril, exactamente el día del primer anuncio de Mythos. El intervalo entre el comunicado y la intrusión pudo haber sido de solo unas horas.

Cadena de suministro de terceros: la vulnerabilidad más difícil de parchear para las empresas de IA

El propio sistema de seguridad de Anthropic puede ser bueno. Pero el punto de entrada esta vez no estaba dentro de Anthropic, sino en un empleado de un contratista.

Las empresas de IA en rápida expansión dependen inevitablemente de muchos proveedores externos — para etiquetado de datos, infraestructura, pruebas y auditorías de cumplimiento. Cada punto de conexión es una brecha potencial.

La ruta esta vez fue: Filtración de Mercor → Cuenta de empleado de proveedor → Entorno de vista previa interno de Anthropic. Cada paso era "problema de otro", pero al final se convirtió en problema de la propia Anthropic.

OpenAI, Google y Meta ya han tenido incidentes de seguridad similares en la cadena de suministro; la diferencia es solo cuál de ellos llega a los titulares.

Qué hizo realmente el grupo

No se sabe por ahora. Bloomberg no lo ha revelado, y Anthropic tampoco ha dicho nada.

Pudieron haber probado los límites del modelo, ejecutado algunos benchmarks, o haber extraído algo y llevárselo. La afirmación "no queríamos causar problemas" no se puede verificar de ninguna manera.

La situación actual de Anthropic es: antes de que termine la investigación, la propia empresa no sabe completamente qué ocurrió en ese entorno de vista previa.

Fuentes de referencia: Some Unknown Group Is Reportedly Using Claude Mythos Without Permission (Gizmodo); CocoLoop, Unauthorized Group Gains Access to Anthropic's Exclusive Cyber Tool Mythos (Cybersecurity News)