Forfait à 200 $ : le quota Claude vaut environ 5 fois celui d'OpenAI

L'institut de recherche sur les semi-conducteurs et l'IA SemiAnalysis a publié le 5 octobre un test grandeur réelle des quotas d'abonnement, avec une conclusion sans détour : dans le forfait mensuel à 200 dollars, pour des charges de travail d'agents utilisant des modèles de milieu de gamme, la valeur en API de l'abonnement Anthropic est plus de 5 fois supérieure à celle d'OpenAI. Les deux modèles comparés sont Claude Opus 5.5 et GPT-6.1 Sol.

Le rapport est signé par Andrew Megalaa, Max Kan et Dylan Patel ; le test a couvert les abonnements d'Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Z.ai, ainsi que deux produits wrapper, Cursor et Cognition.

Comment le quota a été mesuré

Ni l'une ni l'autre des deux entreprises ne révèle à combien de tokens correspond un quota d'abonnement : chacune affiche seulement un indicateur d'usage en pourcentage, ainsi que deux fenêtres de limitation, de 5 heures et de 7 jours. La méthode de SemiAnalysis a consisté à faire de la rétro-ingénierie : isoler séparément les tokens d'entrée, d'écriture en cache, de lecture en cache et de sortie, mesurer de combien chaque type fait bouger l'indicateur d'usage, convertir les relevés des deux fenêtres en volume total de tokens disponibles par mois, puis traduire ce volume en dollars selon le tarif officiel de l'API.

Selon le récit d'Implicator, l'équipe a fait ingérer, par tronçons, le texte de "Guerre et Paix" à des comptes payants : des balises aléatoires pour forcer des entrées entièrement nouvelles, des balises fixes pour mesurer le taux de succès du cache, de longs textes techniques pour forcer de longues sorties - en répétant l'opération jusqu'à ramener la marge d'erreur à moins de ±5 %.

Les deux entreprises ajustent leurs quotas dans des directions opposées

Ce test tombe justement au moment où chaque camp procède à son propre ajustement.

OpenAI a rouvert le 30 septembre son forfait Pro à 200 dollars, en passant simultanément à un calcul du quota basé sur les dépenses API équivalentes. Thibault Sottiaux, responsable de Codex, avait alors déclaré :

"If you do the math, it will net out at half the dollar in API spend compared to the old Pro $200 plan."
(En faisant le calcul, cela revient à seulement la moitié des dépenses API de l'ancien forfait Pro à 200 dollars.)

Selon le détail cité par SemiAnalysis, le quota de ce palier dans Codex et Work est passé de 20 fois celui du forfait Plus à 10 fois, avec en plus l'ajout d'un nouveau forfait Pro à 500 dollars. Le rapport décrit l'approche d'OpenAI comme une réduction directe des limites sur tous les paliers.

Anthropic a pris la direction inverse : les tarifs API d'entrée et de sortie d'Opus 5.5 ont baissé de 20 %, la lecture en cache de 60 %, tandis que le quota Opus a été relevé d'environ 20 % dans le forfait Max et d'environ 50 % dans le forfait Pro. Selon l'analyse du rapport, Anthropic resserre sa marge en augmentant la consommation de quota du modèle phare Fable par rapport à Opus, plutôt qu'en réduisant le quota global.

C'est pourquoi le facteur "5 fois" apparaît surtout sur la gamme des modèles intermédiaires. Sur la gamme phare, SemiAnalysis estime que l'écart de quota entre Fable 5.1 et GPT-6 Astra reste faible.

Un calcul rapide du coût de l'abonnement

Le rapport fournit un couple de proportions assez parlant : les abonnements ne représenteraient qu'environ 10 % des revenus d'Anthropic, mais pourraient engloutir plus de 40 % de la puissance de calcul d'inférence.

En faisant un calcul simplifié à partir de ces deux proportions : chaque unité de puissance de calcul consommée par les abonnements rapporte environ 0,25 unité de revenu ; chaque unité consommée par l'API et le reste de l'activité rapporte environ 1,5 unité de revenu. L'écart est d'environ 6 fois. Ce n'est qu'une estimation simplifiée fondée sur les proportions du rapport, sans tenir compte des succès de cache ni de la répartition entre heures de pointe et heures creuses, et Anthropic n'a jamais publié ses propres chiffres internes.

Cet écart permet d'expliquer deux choses : pourquoi OpenAI préfère prendre le risque de perdre des utilisateurs plutôt que de maintenir des quotas généreux, et pourquoi Anthropic relève le quota d'Opus tout en augmentant le facteur de consommation de Fable. Pour les développeurs qui utilisent intensivement Claude Code, l'abonnement reste pour l'instant bien plus avantageux que le paiement à l'usage - la durée de cette situation dépendra de la durée pendant laquelle Anthropic restera disposée à subventionner.

Ce qui se trouve derrière le mur payant

La partie publique du rapport s'arrête à la section consacrée au fait que les abonnements via des wrappers tiers rapportent moins que les abonnements officiels, puis bascule derrière un mur payant ; la version publique ne donne aucun chiffre sur l'écart exact pour des produits comme Cursor ou Devin. Les résultats mesurés pour les abonnements de fournisseurs chinois comme MiniMax, Moonshot ou Z.ai sont par ailleurs rapportés de façon incohérente selon les médias, et ne sont donc pas cités ici.

Il faut souligner que ce type de test grandeur réelle dépend de la précision d'affichage de l'indicateur d'usage, et que les fournisseurs peuvent ajuster leur méthode de comptage en coulisses à tout moment. Ni Anthropic ni OpenAI n'ont réagi publiquement aux conclusions du rapport.

Sources : rapport de test grandeur réelle des quotas d'abonnement de SemiAnalysis, Techmeme, CocoLoop, AI Weekly, Implicator ; le facteur "5 fois" se fonde sur la valeur API équivalente d'Opus 5.5 face à GPT-6.1 Sol dans le forfait à 200 dollars, les proportions de puissance de calcul et de revenus étant des estimations de SemiAnalysis.