OpenAI réinstaure la limite de cinq heures pour Plus

Thibault Sottiaux, responsable ingénierie chez OpenAI, a annoncé dans la soirée du 24 août (heure du Pacifique) qu'à partir du lendemain, la limite d'utilisation de cinq heures serait rétablie pour les comptes Plus, à la fois sur ChatGPT Work et sur Codex. Cette limite avait été supprimée après le lancement de GPT-5.6, les utilisateurs Plus étant alors passés à un quota calculé par semaine. Les paliers Pro à 100 et 200 dollars n'activeront pas cette limite dans les prochains mois.

"Tomorrow we will bring back the 5h limit for Plus accounts across ChatGPT Work and Codex."

(Demain, nous réinstaurerons la limite de 5 heures pour les comptes Plus sur ChatGPT Work et Codex.)

La raison avancée par Sottiaux est de lisser la charge de calcul : "the 5h limit allows us to smoothen the load on our compute, allowing to keep the plan generous in terms of weekly usage" — la fenêtre de cinq heures répartit mieux la charge, ce qui permet de garder le quota hebdomadaire généreux. Une autre considération vise les nouveaux utilisateurs : en attribuant le quota par semaine, il est facile de tout consommer dès les deux premiers jours, puis de se retrouver perplexe devant les messages d'alerte. Une fois la limite atteinte, l'utilisateur peut attendre la réinitialisation de la fenêtre ou acheter des crédits supplémentaires.

Les 3 % rétrogradés en silence

Presque au même moment, un autre sujet a enflé dans la communauté des développeurs. Depuis le 22 août, des utilisateurs Plus ont signalé les uns après les autres qu'en choisissant GPT-5.6 Sol ou Thinking dans le sélecteur de modèle, les réponses obtenues provenaient en réalité de GPT-5.5-mini. Certains ont identifié un schéma : le niveau Instant fonctionnait normalement, seuls les niveaux Medium et High posaient problème ; le bug se reproduisait en changeant de navigateur, d'application mobile ou de réseau cellulaire, alors qu'un autre compte sur le même réseau n'avait aucun souci. La méthode de vérification qui a circulé dans la communauté consistait à ouvrir les outils de développement et à vérifier directement si le champ resolved_model_slug de la réponse correspondait bien. Le fil principal a rassemblé 13 réponses, et quatre signalements connexes en ont totalisé plus de quarante autres.

Le 26 août, un responsable produit d'OpenAI a publiquement reconnu le problème : environ 3 % des échanges Pro et Thinking avaient été basculés par erreur vers GPT-5.5-mini, le problème a depuis été corrigé, et des excuses ont été présentées aux utilisateurs concernés. Cette déclaration n'apparaît pour l'instant que sur son compte de réseau social personnel, et pas encore sur la page de statut officielle.

3 %, cela paraît peu, mais la répartition est aléatoire. Pour ceux qui achètent un quota hebdomadaire, tomber justement sur la requête où le modèle doit réécrire tout un module n'a rien à voir avec tomber sur une simple conversation informelle. Plus gênant encore, cela ne génère aucune erreur visible : la réponse rétrogradée reste fluide, seulement un cran moins approfondie, et il est difficile de s'en apercevoir à moins d'aller examiner le corps de la réponse.

Trois niveaux de sièges qui clarifient tout

La même semaine, une autre grille tarifaire est entrée en vigueur. OpenAI avait ouvert, le 10 août, une liste d'attente pour le siège premium de ChatGPT Business, clos les inscriptions le 20 août, et l'a officiellement déployé cette semaine. Le prix est de 125 dollars par personne et par mois, soit l'équivalent de 100 dollars par personne et par mois en facturation annuelle ; le siège standard coûte 25 dollars par mois, ou 20 dollars par mois en formule annuelle. Le siège premium offre cinq fois l'usage du siège standard et n'est pas soumis à la fenêtre de cinq heures ; les deux types de sièges peuvent être librement attribués et repris au sein d'un même espace de travail. Condition promotionnelle : les 10 000 premiers clients Business éligibles reçoivent 100 dollars de crédit d'espace de travail (2 500 crédits) pour chaque siège premium ajouté, dans la limite de cinq sièges.

En mettant les trois grilles tarifaires côte à côte, la logique devient claire. Du siège standard au siège premium, l'abonnement mensuel est multiplié par cinq, l'usage aussi, et le prix par unité d'usage ne change pas — l'argent supplémentaire achète exactement une chose : ne plus être soumis à la limite de cinq heures. Côté particuliers, même logique : le Plus à 20 dollars par mois voit la fenêtre réinstaurée, le Pro à 100 dollars reste sans restriction, le multiplicateur restant de cinq. En gros, OpenAI a fixé le coefficient de prix du produit "pouvoir l'utiliser sans limite à tout moment" à cinq fois, de façon cohérente aussi bien côté particuliers que côté équipes.

Pour les développeurs en Chine, l'impact direct reste limité. La plupart passent par l'API ou des relais tiers, la fenêtre de cinq heures touchant surtout ceux qui utilisent Plus directement pour faire tourner Codex. Ce qui mérite le plus attention, c'est le mécanisme de routage lui-même : lorsqu'une entreprise fournit simultanément trois niveaux d'inférence — Pro, Thinking et mini — dont les coûts diffèrent de plusieurs multiples, et que le pouvoir d'attribution se trouve côté serveur, la question de savoir si le niveau payé correspond au niveau choisi cesse d'être un détail technique pour devenir un problème de facturation. Cette fois, c'était 3 %, détectés, reconnus, corrigés ; que la prochaine fois soit repérée de la même façon dépendra du nombre de personnes prêtes à aller vérifier ce champ.

Sources : 9to5Mac, CocoLoop, communauté de développeurs OpenAI, page tarifaire officielle d'OpenAI ; vérifiés : le périmètre du rétablissement de la limite de cinq heures, les tarifs mensuels et annuels des sièges premium et standard, ainsi que les conditions de reproduction de l'anomalie de routage.