Claude Managed Agents coordina hasta 1.000 subagentes

Anthropic actualizó el 9 de octubre las notas de versión de la plataforma Claude: los flujos de trabajo dinámicos (dynamic workflows) llegan a Claude Managed Agents en versión beta. Cuando un agente gestionado recibe una tarea grande, puede escribir él mismo un flujo de trabajo: el agente principal divide la tarea, la reparte por fases entre un grupo de subagentes y al final fusiona los resultados. Una sola ejecución puede coordinar en paralelo hasta 1.000 agentes.

La forma de activarlo figura en la documentación: la solicitud debe incluir la cabecera beta managed-agents-2026-04-01, el campo multiagent del agente se establece con el tipo multiagent_20261001 y se activa el flujo de trabajo. El flujo se ejecuta en segundo plano en el servidor, y quien lo invoca sigue el progreso mediante los eventos workflow_run del flujo de eventos de la sesión.

La prueba de los 70 errores

El ejemplo que ofrece Anthropic es una revisión de código. El equipo escondió 70 errores en una base de código de 116.000 líneas y puso a un solo agente a buscarlos: en cada ronda encontraba entre 14 y 27, con una variación considerable de una ronda a otra. Con el flujo de trabajo dinámico, el resultado se estabilizó en 66 errores.

Estas cifras proceden de la propia prueba de Anthropic, y la tarea es de las que se dividen con facilidad: la base de código puede cortarse por módulos, cada subagente revisa un tramo y hay poca dependencia entre ellos. En tareas que exigen un razonamiento encadenado, como el hilo argumental de un informe largo, no hay datos oficiales sobre cuánta ventaja queda tras la división. El medio tecnológico The Decoder también advierte de que serán los usuarios, con su propia carga de trabajo, quienes tengan que comprobar si la conclusión se generaliza.

El coste es otro terreno sin fondo conocido. En la documentación, Anthropic avisa de que este tipo de flujos consume muchísimos tokens y recomienda empezar a pequeña escala. El reportaje de The Decoder cita la valoración de un ingeniero veterano de OpenAI sobre los enjambres de agentes:

"a massive waste of tokens" (un enorme derroche de tokens)

Las notas de versión no detallan ni la facturación de la beta ni el rango de consumo de tokens por ejecución.

La misma función, dos formas de ejecutarla

Los flujos de trabajo dinámicos ya estaban en Claude Code, donde se lanzaron como vista previa de investigación a finales de mayo de este año. Al comparar ambas versiones, las diferencias se concentran en tres puntos:

  • Dónde se ejecuta el script: en Claude Code, el script del flujo corre en la máquina del propio usuario; en los agentes gestionados, corre en los servidores de Anthropic.
  • Quién lo inicia: en Claude Code, el usuario puede abrir el script, modificarlo y volver a ejecutarlo; en los agentes gestionados, es el propio agente quien decide cuándo arrancar el flujo.
  • Cómo se controla el coste: según la comparación de un desarrollador independiente, la versión gestionada se factura por sesión y se puede fijar un tope para cada una.

Claude Managed Agents es un servicio gestionado que Anthropic lanzó en abril de este año, dirigido a agentes de nivel de producción que deben funcionar de forma continua durante varias horas o más, con el entorno de ejecución a cargo de Anthropic. Al llevar allí los flujos dinámicos, quien integra agentes de Claude en su propio producto no necesita montar una capa de orquestación ni de planificación de concurrencia: la división de la tarea por el agente principal, la ejecución por los subagentes y la consolidación de resultados ocurren en el servidor.

La versión de Claude Code se parece más a una herramienta a mano del desarrollador, que permite ver cada paso y modificar el script en cualquier momento; la versión gestionada se acerca más a "entregar y esperar el resultado". La primera ofrece más control; la segunda traslada la operación a Anthropic y, a la vez, cede al propio modelo parte de la decisión sobre cuántos agentes abrir y cuántos tokens gastar en una tarea. Lo que más preocupa a las empresas, el tope de coste por sesión, es decir, cómo se configura y cuál es el valor por defecto, habrá que esperar a la documentación de la versión definitiva.

La función sigue en beta, y los parámetros de la interfaz y los nombres de los campos pueden cambiar más adelante.

Fuentes: notas de versión de la plataforma Claude, The Decoder, CocoLoop, ITHome; se contrastaron el límite de agentes en paralelo, el tamaño de la base de código de la prueba y el número de errores detectados.