Le 7 avril, Anthropic a annoncé quelque chose d'assez inhabituel : ils ont publié un nouveau modèle appelé Claude Mythos, tout en déclarant que ce modèle n'est pas ouvert au public.
Pas « disponible plus tard », mais « actuellement réservé à 40 organisations, les autres attendent ».
Ce projet s'appelle Project Glasswing.
À quel point Mythos est-il puissant
D'abord, les données :
| Benchmark | Claude Opus 4.6 | Claude Mythos | Variation |
|---|---|---|---|
| SWE-bench Verified | 80,8 % | 93,9 % | +13,1 % |
| SWE-bench Pro | Non publié | 77,8 % | Actuellement en tête |
La deuxième place sur SWE-bench Pro est actuellement occupée par GLM-5.1 de Zhipu (58,4 %), la troisième par GPT-5.4 (57,7 %). Mythos avec 77,8 % distance le deuxième de près de 20 points de pourcentage, un écart considérable.
Mais Anthropic ne se contente pas de grimper dans les classements. Ils ont laissé Mythos analyser des bases de code réelles et il a trouvé :
- Des milliers de vulnérabilités zero-day dans les systèmes d'exploitation et navigateurs courants
- Une vulnérabilité cachée dans FFmpeg depuis 16 ans – cette vulnérabilité avait déjà été scannée plus de 5 millions de fois par des outils de sécurité traditionnels, tous l'ont manquée
Le Chief Security Officer de Cisco, Anthony Grieco, a déclaré : « Cela représente un changement de paradigme profond, et aussi un signal clair – les méthodes précédentes de renforcement des systèmes ne suffisent plus. »
Quelle est la logique de Project Glasswing
Anthropic accorde à ces 40 organisations un accès anticipé à Mythos avec un seul objectif : le travail de cybersécurité défensive.
Les partenaires actuels ayant accès incluent : Amazon, Apple, Broadcom, Cisco, CrowdStrike, Linux Foundation, Microsoft, Palo Alto Networks.
Anthropic fournit :
- 100 millions de dollars de crédits API, couvrant les tests de sécurité et la recherche des participants
- 4 millions de dollars de dons directs à des organisations de sécurité open source
Pourquoi ce format « édition limitée » ?
L'explication officielle est directe : Mythos possède des capacités en cybersécurité « actuellement bien supérieures à tout autre modèle d'IA », mais précisément pour cette raison, il pourrait également être utilisé pour accélérer des cyberattaques à grande échelle. Anthropic estime que le risque de rendre ce modèle public sans mesures de protection adéquates est trop élevé.
Ils ont donc choisi une solution intermédiaire : d'abord le donner aux défenseurs, pour que les équipes de sécurité puissent appliquer des correctifs à l'avance, avant d'envisager une ouverture plus large.
Cette stratégie est-elle correcte
Il convient d'y réfléchir.
La logique traditionnelle de publication des modèles d'IA est : publier, tester, découvrir des problèmes, corriger, répéter. Ce processus est public, le risque est diffusé – attaquants et défenseurs reçoivent de nouveaux outils en même temps.
L'approche de Glasswing est inverse : d'abord créer une fenêtre de temps pour les défenseurs, afin qu'ils utilisent Mythos pour trouver et corriger proactivement les vulnérabilités, avant d'envisager un accès plus large.
Du point de vue de la théorie des jeux, cette conception a du sens – si les défenseurs agissent en premier, le coût pour les attaquants d'utiliser le même modèle est considérablement plus élevé.
Mais l'efficacité réelle dépend de deux choses : si ces 40 organisations peuvent réellement corriger les vulnérabilités critiques dans cette fenêtre ; et si les capacités du modèle elles-mêmes présentent un risque de fuite (après tout, l'existence de Mythos a déjà été révélée par les médias plus tôt en raison d'une fuite de données).
Quel est le niveau de Mythos
C'est le modèle qu'Anthropic décrit explicitement comme « le plus puissant à ce jour », il ne s'agit pas d'une itération de la série Opus 4.x, mais d'une nouvelle génération.
Il y a quelques semaines, les médias ont révélé prématurément l'existence de Mythos en raison d'une fuite de données. Fortune a rapporté qu'en interne, Anthropic le décrivait comme « un saut quantique en termes de capacités ». Désormais, le nom et les capacités sont officiellement confirmés, mais pas sous forme de lancement public, mais comme un programme de coopération ciblé.
Ce qu'Anthropic attend n'est pas encore clair. Mais compte tenu des 77,8 % sur SWE-bench Pro, les capacités de code de ce modèle sont déjà d'un tout autre niveau.
Sources de référence : Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative (TechCrunch) ; Anthropic debuts Project Glasswing, CocoLoop, leveraging its powerful Mythos model to reinforce software security (SiliconAngle) ; Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses (Fortune) ; Exclusive: Anthropic Mythos AI model representing step change in power revealed in data leak (Fortune)