La nouvelle la plus fracassante dans le monde de l'IA début avril n'a pas été le lancement d'un nouveau modèle par une entreprise, mais l'annonce soudaine qu'OpenAI, Anthropic et Google, trois concurrents féroces qui se disputent habituellement le marché, ont décidé de s'unir pour faire face aux entreprises d'IA chinoises.
Plus précisément, les trois entreprises ont commencé à partager des renseignements via le Frontier Model Forum (un forum fondé en 2023 par ces sociétés avec Microsoft), dans le but de lutter contre les « attaques par distillation » — le fait pour des concurrents d'utiliser les sorties de votre grand modèle pour entraîner leurs propres modèles plus petits.
Trois entreprises chinoises ont été nommées : DeepSeek, Moonshot AI (la société mère de Kimi) et MiniMax.
Qu'est-ce qu'une « attaque par distillation » ?
La méthode n'est pas compliquée : insérer une multitude d'invites soigneusement conçues dans le modèle cible, collecter les résultats renvoyés et les utiliser pour entraîner votre propre modèle.
Vous n'avez pas besoin de connaître l'architecture du modèle cible, ni d'obtenir les poids, pour que votre modèle apprenne une grande partie de la manière de raisonner et de la structure de connaissances de l'autre. OpenAI soupçonnait déjà cela depuis la sortie de DeepSeek R1, et Sam Altman avait alors déclaré publiquement que DeepSeek avait « distillé indûment des modèles GPT ».
Désormais, Anthropic a fourni des chiffres concrets : les trois entreprises chinoises ont effectué plus de 16 millions d'interactions avec Claude via environ 24 000 comptes frauduleux.
Ce n'est pas un comportement d'utilisateur normal. 16 millions d'interactions sont une extraction de données à l'échelle industrielle et systématique, réalisée via un grand nombre de comptes falsifiés pour contourner la détection par les conditions d'utilisation de la plateforme.
Pourquoi trois ennemis sont-ils soudainement devenus alliés ?
Dire que ces trois entreprises sont concurrentes est un euphémisme — OpenAI et Anthropic se disputent les mêmes contrats d'entreprise, et Google affronte directement les deux en même temps.
Mais lorsque l'ampleur du problème devient si grande que les mesures défensives d'une seule entreprise ne peuvent plus le supporter, cette concurrence cède temporairement la place. Le mécanisme de partage de renseignements du Frontier Model Forum signifie que lorsqu'une entreprise découvre un nouveau modèle d'attaque par distillation, les deux autres peuvent mettre à jour leurs stratégies de défense de manière synchrone.
Qu'a fait Anthropic dans cette collaboration ? Il a lancé le « Project Glasswing » — limitant l'accès au modèle Claude Mythos de haute capacité à des partenaires spécifiques, avec des mécanismes de détection de sécurité plus stricts, et s'est engagé à fournir 100 millions de dollars de crédits d'utilisation à des partenaires de sécurité défensive comme AWS, Google et Microsoft.
Qu'ont réellement volé les entreprises chinoises ?
Selon les accusations d'Anthropic, les domaines de distillation incluent : la vision par ordinateur, la génération de code, le raisonnement complexe et plusieurs autres directions de capacités fondamentales.
Une comparaison des feuilles de route produits de ces trois entreprises permet de mieux comprendre :
| Entreprise | Produit principal | Lien avec les capacités accusées |
|---|---|---|
| DeepSeek | Modèles de raisonnement série R | Capacité de raisonnement complexe |
| Moonshot AI | Modèle à contexte long Kimi | Compréhension de documents, capacité de code |
| MiniMax | Génération vidéo, multimodal | Compréhension visuelle |
Chaque entreprise peut avoir un objectif de distillation différent, mais le point commun est : elles n'ont pas besoin de dépenser des centaines de millions de dollars en coûts d'entraînement pour obtenir des capacités proches du SOTA.
Qu'est-ce que cela signifie pour l'IA open source ?
Dans une perspective plus large, la formation de cette alliance marque dans une certaine mesure l'entrée de l'industrie de l'IA dans la « phase de protection de la propriété intellectuelle ».
Auparavant, tout le monde parlait d'ouverture de l'IA, d'open source et de partage de modèles. Aujourd'hui, Anthropic restreint directement l'accès à son modèle le plus puissant, et OpenAI renforce également l'application de ses conditions d'utilisation.
Si la prévention de la distillation devient une action standard de l'industrie, les chercheurs et les petites entreprises qui dépendent des appels API pour optimiser leurs propres modèles seront également affectés — comment distinguer les « appels API normaux » de la « collecte systématique par distillation » est un problème difficile à résoudre tant sur le plan technique que politique.
Actuellement, les trois entreprises chinoises nommées n'ont pas répondu publiquement à ces accusations.
Source de référence : CocoLoop, OpenAI, Anthropic, Google Unite to Combat Model Copying in China (Bloomberg) ; OpenAI, Google, Anthropic Unite Against AI Model Theft (Built In) ; OpenAI, Anthropic and Google Unite Against China AI Distillation (resultsense.com)