Dans la soirée du 3 septembre, heure de Pékin, les services de modèles d'Anthropic, xAI et OpenAI sont tombés en panne l'un après l'autre en une heure et demie. La page de statut d'Anthropic a publié sa première annonce à 21h26 heure de Pékin (13h26 UTC), toute la gamme Grok de xAI a été marquée comme dégradée par des plateformes en aval à 21h41, et OpenAI a commencé à signaler une hausse du taux d'erreurs de ChatGPT et Codex vers 22h56. À 23h15, les incidents des trois entreprises restaient encore "en cours d'investigation" ou "en cours de correction", aucune n'avait annoncé de rétablissement.
Sur la même période, Gemini et Vertex AI de Google n'ont enregistré aucun incident, et sur le tableau agrégateur de statuts d'un tiers, la case de Google restait au vert avec la mention "All services operational".

Chronologie : les trois entreprises entrent en scène l'une après l'autre
Anthropic en premier. À 21h26, la page de statut indiquait "investigation d'une hausse du taux d'erreurs des requêtes vers Claude Mythos 5.1, Fable 5.1, Opus 5" ; 15 minutes plus tard, le message est devenu "cause identifiée, correctif en cours". À 21h50, la liste complète a été ajoutée : les deux générations 5.1 et 5 de Mythos et Fable, Opus 5, Opus 4.8 et Opus 4.6 étaient tous concernés, Haiku et Sonnet ne figuraient pas dans la liste. La mise à jour de 22h49 se limitait à la phrase "correctif toujours en cours".
xAI a suivi de très près. La page de statut propre à xAI a renvoyé une erreur 403 lors de la consultation, impossible donc de la vérifier directement. Ce qui est confirmé, c'est que Cursor a publié à 21h41 une annonce "investigation d'une dégradation de service", précisant comme éléments touchés "tous les modèles Grok, Automations, Cloud Agents, Grok Bot et Review Agents". Sur le tableau agrégateur, xAI était la seule des quatre entreprises marquée en rouge "Down".
OpenAI est entrée en scène en dernier, mais avec l'impact le plus perceptible pour les utilisateurs. Vers 22h56, la page de statut affichait "Elevated errors across ChatGPT and Codex", avec pour seule explication "en cours d'investigation". À ce moment-là, certains utilisateurs ouvrant chatgpt.com recevaient un code HTTP 404, une erreur qui provient généralement d'un nœud de périphérie ne trouvant pas de route, de nature différente des erreurs 5xx côté modèle.


L'aval a été le premier à s'en apercevoir
La page de statut de Cursor affichait ce soir-là deux incidents simultanés. Le premier était la dégradation de Grok à 21h41, le second une "hausse du taux d'erreurs des modèles Anthropic" à 22h17, ce dernier étant explicitement attribué à un "problème amont chez Anthropic" provoquant des erreurs sur les requêtes vers Fable 5.1, Fable 5, Opus 5, Opus 4.8 et Opus 4.6, "certains utilisateurs rencontreront des erreurs ou des échecs de tours d'Agent".

Cette liste correspond à celle publiée par Anthropic elle-même, à l'exception de Mythos, que Cursor n'intègre de toute façon pas. Pour les outils de programmation assistée par IA, voir deux fournisseurs amont tomber en panne le même soir a d'un coup réduit de moitié la capacité de repli promise par l'argument commercial de la "redondance multimodèle".
Les développeurs en Chine se sont retrouvés encore plus démunis. La plupart passent par des API relais ou des plateformes agrégatrices, si bien que l'information sur la panne leur parvient après une couche supplémentaire de retransmission ; les fournisseurs relais n'affichent généralement qu'une "anomalie en amont", sans préciser quelle entreprise ni quel modèle. Ce soir-là, Haiku et Sonnet de Claude ne figuraient pas dans la liste des modèles touchés, et Gemini est resté disponible en continu — ceux qui le savaient pouvaient changer de modèle directement, ceux qui l'ignoraient ne pouvaient qu'actualiser la page et attendre.
Google épargné : indice ou coïncidence ?
La première hypothèse apparue dans la communauté technologique chinoise était un "problème de liaison en amont ou de DNS". Cette hypothèse ne peut pas être vérifiée pour l'instant. Deux éléments jouent en sa défaveur : la liste des incidents de Google Cloud n'a enregistré aucun ajout ce jour-là, Gemini a fonctionné normalement toute la journée ; et la formulation d'Anthropic, "cause identifiée", pointe vers l'interne, alors qu'une panne d'infrastructure partagée est généralement décrite comme venant d'un "fournisseur amont".
Il existe aussi des éléments en sa faveur. Chez Anthropic, seuls les grands modèles ont été touchés, les petits modèles ont été épargnés ; chez xAI, ce qui a été marqué, ce sont "tous les modèles Grok" ; OpenAI n'a listé que ChatGPT et Codex, la colonne API restant au vert. Chez les trois entreprises, l'étendue des dégâts s'est concentrée sur les grands modèles côté inférence, ce qui ressemble davantage à un problème régional chez un fournisseur de capacité de calcul qu'à une panne de DNS, où "plus rien ne serait accessible".
Un moniteur de disponibilité tiers fournit un autre point de comparaison. À 23 h 37, heure de Pékin (15 h 37 UTC), il signalait neuf services : outre Cursor, Claude et OpenAI, des dégradations partielles chez Cloudflare, Supabase, GitHub, Notion, SendGrid et Twilio. La liste semble conforter l'hypothèse d'un amont partagé, mais la page de statut officielle de Cloudflare n'a enregistré aucun nouvel incident ce soir-là ; les deux entrées ouvertes concernaient R2 et WARP et dataient de fin août, et rien ne relie les autres dégradations à l'événement de ce soir. La même page affichait Grok de nouveau opérationnel à 23 h 37.

Ces indices ne permettent de conclure qu'à ceci : "l'inférence des grands modèles des trois entreprises a rencontré des problèmes sur la même période" ; aller plus loin relèverait de la spéculation. Aucune des trois n'a publié de rapport d'incident, et les mises à jour publiques ne mentionnent aucun tiers. Quelle explication se confirmera dépendra des bilans post-mortem de chaque entreprise, qui prennent généralement de trois à cinq jours ouvrés.
Sources : page de statut d'Anthropic, page de statut d'OpenAI, page de statut de Cursor, liste des incidents Google Cloud, CocoLoop et captures d'écran d'utilisateurs de la communauté ; la liste des modèles touchés et les étapes de chaque incident ont été vérifiées à partir du texte original des pages de statut, la page de statut de xAI a renvoyé une erreur 403 lors de la consultation, son étendue a donc été déterminée d'après la page de statut de Cursor et le tableau agrégateur d'un tiers.