Le 7 avril, le jour même de l'annonce publique de Claude Mythos, une organisation Discord inconnue avait déjà pénétré son système.
Anthropic n'a détecté l'incident que le 21 avril — l'entreprise a mis deux semaines complètes à réaliser que le modèle d'IA le plus strictement contrôlé au monde était utilisé gratuitement par un groupe d'inconnus.
Comment ce groupe est entré
Le chemin emprunté peut se résumer ainsi :
- Mercor, une start-up d'entraînement d'IA, a subi une fuite de données, exposant des identifiants internes.
- Un groupe Discord surveillait constamment GitHub, cherchant spécifiquement des informations sur des modèles d'IA non encore publiés.
- Les membres du groupe ont combiné les données divulguées de Mercor avec les identifiants d'"un employé d'un fournisseur tiers d'Anthropic".
- À l'aide d'outils de reconnaissance réseau — du type courant dans le cercle de la recherche en sécurité — ils ont localisé et accédé à l'environnement de prévisualisation de Mythos.
Bloomberg a contacté un membre de l'organisation, qui a déclaré qu'ils "étaient simplement intéressés par le nouveau modèle, sans intention de causer des problèmes".
À vous de croire ou non.
Ce qu'Anthropic en dit
La déclaration officielle de l'entreprise est la suivante :
Nous enquêtons sur un rapport concernant un accès non autorisé à la version de prévisualisation de Claude Mythos, dont le point d'entrée provient de l'environnement de l'un de nos fournisseurs tiers.
Le ton standard de la communication de crise en entreprise. Aucune mention de l'ampleur de l'intrusion, aucune information sur ce que le groupe a vu, ni aucune indication quant à d'éventuels vols de données.
Pourquoi cette affaire est plus grave qu'il n'y paraît
Mythos n'est pas un modèle non publié ordinaire.
Anthropic avait clairement indiqué lors de l'annonce que le modèle ne serait fourni qu'à 40 entreprises évaluées, car ses performances en matière de capacités de cyberattaque avaient déclenché un seuil de sécurité interne. En d'autres termes, Anthropic elle-même estimait qu'il ne pouvait pas être largement diffusé.
Une IA "trop dangereuse pour être publiée publiquement" a été accessible à un groupe d'identité inconnue pendant 15 jours — cela n'a rien à voir avec "quelqu'un a utilisé un chatbot de test interne".
Plus important encore : ils sont entrés le 7 avril, le jour même de la première annonce de Mythos. L'intervalle entre le communiqué et l'intrusion n'a peut-être été que de quelques heures.
Chaîne d'approvisionnement tierce : la vulnérabilité la plus difficile à corriger pour les entreprises d'IA
Le propre système de sécurité d'Anthropic est peut-être bon. Mais le point d'entrée cette fois ne se trouvait pas à l'intérieur d'Anthropic, mais chez un employé d'un sous-traitant.
Les entreprises d'IA en pleine expansion dépendent inévitablement de nombreux fournisseurs externes — pour l'étiquetage des données, l'infrastructure, les tests et les audits de conformité. Chaque point de connexion est une brèche potentielle.
Le chemin cette fois était : Fuite de Mercor → Compte d'employé d'un fournisseur → Environnement de prévisualisation interne d'Anthropic. Chaque étape était "le problème de quelqu'un d'autre", mais est finalement devenue le problème d'Anthropic elle-même.
OpenAI, Google et Meta ont tous connu des incidents de sécurité similaires dans leur chaîne d'approvisionnement ; la différence réside uniquement dans celui qui fait la une des journaux.
Qu'a réellement fait ce groupe ?
On ne le sait pas pour l'instant. Bloomberg n'a rien divulgué, et Anthropic n'a rien dit non plus.
Ils ont peut-être simplement testé les limites du modèle, exécuté quelques benchmarks, ou bien extrait quelque chose et l'ont emporté. L'affirmation "nous ne voulions pas causer de problèmes" ne peut être vérifiée d'aucune manière.
La situation actuelle d'Anthropic est la suivante : avant la fin de l'enquête, l'entreprise elle-même ne sait pas complètement ce qui s'est passé dans cet environnement de prévisualisation.
Sources de référence : Some Unknown Group Is Reportedly Using Claude Mythos Without Permission (Gizmodo) ; CocoLoop, Unauthorized Group Gains Access to Anthropic's Exclusive Cyber Tool Mythos (Cybersecurity News)