Unidad yemení habría usado Claude para escribir código de guiado de misiles

El 10 de septiembre, Anthropic publicó un informe de inteligencia de amenazas que clasifica los casos de uso indebido de Claude detectados entre diciembre de 2025 y agosto de 2026 en siete categorías: operaciones cibernéticas, operaciones de influencia, vigilancia, desarrollo de armas convencionales, uso indebido biológico, fraude y estafas, y destilación ilícita.

La categoría de armas convencionales suma 6 casos, distribuidos según la atribución geográfica del informe en 3 en China, 2 en Rusia y 1 en Yemen. El caso descrito con más detalle es el de Yemen.

Una unidad, tres proyectos

El informe describe una unidad de desarrollo de armas en el norte de Yemen que avanzaba simultáneamente en tres proyectos: un cohete guiado, un misil balístico multietapa con un alcance superior a 2.000 km y una serie de variantes planeadoras hipersónicas.

El uso de Claude Code se centró en el software de guiado, navegación y control, comúnmente llamado GNC. En concreto, el informe enumera cuatro tareas: escribir código de control y estimación de posición, ajustar parámetros, construir firmware, ejecutar simulaciones de vuelo. En palabras de Anthropic, los implicados usaron Claude Code para realizar parte del trabajo que normalmente requeriría ingenieros de software.

Hubo dos métodos para eludir los mecanismos de seguridad. Uno fue ocultar el uso militar del software, presentando las solicitudes como problemas genéricos de algoritmos de control; el otro fue dividir todo el trabajo en sesiones independientes entre sí, de modo que cada sesión solo veía un componente y no permitía reconstruir el plan completo.

Lo que los expuso fue un fallo. Según el informe, una prueba de lanzamiento del cohete guiado no tuvo éxito, y el operador volvió a preguntarle a Claude el motivo del fallo; esa pregunta activó una alerta de seguridad.

Según Anthropic, los mecanismos de seguridad bloquearon muchas de esas solicitudes, pero no todas; las cuentas implicadas fueron baneadas de forma permanente.

Hay un punto que conviene aclarar: el informe no identifica a qué facción pertenece esta unidad. "Norte de Yemen" es la descripción geográfica que ofrece el informe; la asociación con los hutíes proviene de inferencias periodísticas que Anthropic no ha confirmado. El informe también deja claro que no hay pruebas de que estos proyectos hayan producido armas utilizables.

La categoría de vigilancia tiene una escala mayor

De las siete categorías, la de vigilancia es la que más impresiona por las cifras. El informe menciona una plataforma llamada Lakana 360 en Malí, que cubre alrededor de 25 millones de tarjetas SIM y está conectada a tres operadoras móviles nacionales. Esta escala ya excede el uso indebido de individuos aislados y corresponde a una infraestructura sistemática.

En la categoría de destilación ilícita, los protagonistas son varios laboratorios chinos; en la línea vinculada a Alibaba, la cifra es de 151 millones de interacciones en tres meses, y el informe describe esta categoría como una "operación encubierta a escala industrial". Esta parte ya había sido reportada por separado con anterioridad.

El informe también aclara un punto sobre los modelos: los casos de uso indebido involucraron mayoritariamente versiones más antiguas, como Claude Opus 4 y Sonnet 4.5. Según el informe, las salvaguardas biológicas de los modelos antiguos "sirven sobre todo para impedir que los principiantes accedan a contenido ya conocido sobre armas biológicas", mientras que la nueva generación de modelos, de nivel Fable y Mythos, tiene restricciones más estrictas, incluyendo consultas amplias sobre investigación biológica de doble uso, que también se han acotado.

Dos documentos publicados el mismo día

El 10 de septiembre, Anthropic no publicó solo este informe. Ese mismo día apareció también una evaluación de capacidades realizada por el equipo de frontier red team y el equipo de inteligencia de amenazas, que midió hasta dónde llegan los modelos en tareas militares y de inteligencia, incluyendo geolocalización de fotos, vinculación de cuentas, guiado terminal de drones y navegación autónoma cuando el GPS está interferido. La conclusión de esa evaluación es que, en algunas tareas, los modelos ya pueden hacer lo que antes solo un pequeño grupo de expertos capacitados podía lograr.

Al poner ambos documentos uno junto al otro, el orden cronológico se invierte. La evaluación de capacidades responde a "si se puede hacer", mientras que el informe de inteligencia de amenazas responde a "alguien ya lo está haciendo". La ventana temporal que cubre este último comienza en diciembre de 2025, más de medio año antes de las pruebas de la evaluación de capacidades.

Si se observa el ritmo de divulgación pública de Anthropic durante el último año, esta línea se está intensificando: desde los primeros avisos esporádicos de baneo de cuentas, pasando por la divulgación de incidentes puntuales como el del sistema de agua en México, hasta este balance anual organizado por categoría y atribución geográfica. En cuanto a si esta densidad de divulgación se convertirá en norma del sector, por ahora ninguna otra empresa cuenta con material público comparable.

Fuentes: informe de inteligencia de amenazas de Anthropic, CocoLoop, United Daily News, unwire.hk; se verificaron el momento de publicación del informe, la distribución del número de casos y la presentación de las tres líneas de producto del proyecto en Yemen.