Anthropic a mis à jour le 9 octobre les notes de version de la plateforme Claude : les workflows dynamiques (dynamic workflows) arrivent en bêta dans Claude Managed Agents. Lorsqu'un agent géré reçoit une tâche volumineuse, il peut écrire lui-même un workflow : l'agent principal décompose la tâche, la répartit par étapes entre un groupe de sous-agents, puis fusionne les résultats. Une seule exécution peut coordonner en parallèle jusqu'à 1 000 agents.
La méthode d'activation figure dans la documentation : la requête doit porter l'en-tête bêta managed-agents-2026-04-01, le champ multiagent de l'agent est défini sur le type multiagent_20261001 et le workflow est activé. Le workflow s'exécute en arrière-plan sur le serveur, et l'appelant suit l'avancement grâce aux événements workflow_run du flux d'événements de la session.
Le test des 70 bugs
L'exemple donné par Anthropic est une revue de code. L'équipe a caché 70 bugs dans une base de code de 116 000 lignes et a confié la recherche à un agent seul : à chaque passage, il en trouvait de 14 à 27, avec des écarts sensibles d'un passage à l'autre. Avec le workflow dynamique, le résultat s'est stabilisé à 66 bugs.
Ces chiffres proviennent du propre test d'Anthropic, et la tâche est de celles qui se découpent facilement : la base de code peut être tranchée par modules, chaque sous-agent examine une portion, et les dépendances entre elles sont faibles. Pour des tâches exigeant un raisonnement continu, comme l'enchaînement argumentatif d'un long rapport, aucune donnée officielle n'indique ce qu'il reste du gain après découpage. Le média spécialisé The Decoder rappelle lui aussi que c'est aux utilisateurs de vérifier, sur leur propre charge de travail, si la conclusion se généralise.
Le coût est un autre point sans plancher connu. Dans la documentation, Anthropic prévient que ce type de workflow consomme énormément de tokens et conseille de commencer à petite échelle. L'article de The Decoder cite l'avis d'un ingénieur senior d'OpenAI sur les essaims d'agents :
« a massive waste of tokens » (un gaspillage massif de tokens)
Les notes de version ne précisent ni les modalités de facturation de la bêta ni la fourchette de consommation de tokens par exécution.
Une même fonction, deux façons de l'exécuter
Les workflows dynamiques existaient déjà dans Claude Code, où ils ont été lancés en préversion de recherche fin mai de cette année. En comparant les deux versions, les différences se concentrent sur trois points :
- Où tourne le script : dans Claude Code, le script du workflow s'exécute sur la machine de l'utilisateur ; avec les agents gérés, il s'exécute sur les serveurs d'Anthropic.
- Qui le déclenche : dans Claude Code, l'utilisateur peut ouvrir le script, le modifier et le relancer ; avec les agents gérés, c'est l'agent lui-même qui juge du moment de lancer un workflow.
- Comment maîtriser les coûts : d'après la comparaison d'un développeur tiers, la version gérée est facturée par session, avec la possibilité de fixer un plafond pour chacune.
Claude Managed Agents est un service géré qu'Anthropic a lancé en avril de cette année, destiné aux agents de niveau production qui doivent tourner en continu pendant plusieurs heures ou plus, l'environnement d'exécution étant à la charge d'Anthropic. En y apportant les workflows dynamiques, ceux qui intègrent des agents Claude à leur propre produit n'ont plus à bâtir eux-mêmes la couche d'orchestration ni l'ordonnancement de la concurrence : la décomposition par l'agent principal, l'exécution par les sous-agents et la consolidation des résultats se font côté serveur.
La version de Claude Code ressemble davantage à un outil sous la main du développeur, qui permet de voir chaque étape et de modifier le script à tout moment ; la version gérée se rapproche plutôt du principe « confier la tâche et attendre le résultat ». La première offre plus de contrôle ; la seconde transfère l'exploitation à Anthropic et cède aussi au modèle une part de la décision sur le nombre d'agents ouverts et le volume de tokens dépensés pour une tâche. Ce qui préoccupe le plus les entreprises, le plafond de coût par session, c'est-à-dire la manière de le configurer et sa valeur par défaut, ne sera connu qu'avec la documentation de la version finale.
La fonction est pour l'instant en bêta, et les paramètres d'interface comme les noms de champs pourront évoluer.
Sources : notes de version de la plateforme Claude, The Decoder, CocoLoop, ITHome ; vérification de la limite d'agents en parallèle, de la taille de la base de code de test et du nombre de bugs détectés.