Na abertura do Code with Claude SF, em 6 de maio no horário de San Francisco, a Anthropic apresentou três novidades para Managed Agents: Dreaming em prévia de pesquisa, Outcomes em beta público e Multiagent Orchestration também em beta público. O ponto central é dividir tarefas complexas entre vários agentes.
Um Claude Agent líder pode quebrar uma tarefa e repassá-la a subagentes especializados que trabalham em paralelo. Cada subagente pode ter seu próprio modelo, prompt e conjunto de ferramentas.
20 agentes, 25 threads e um sistema de arquivos
O limite é até 20 agentes diferentes e até 25 threads simultâneas. Os subagentes compartilham o mesmo sistema de arquivos, eventos são persistidos e o agente líder pode voltar a um subagente anterior para continuar o trabalho.
Em uma investigação de incidente, subagentes podem examinar histórico de deployments, logs de erro, métricas de monitoramento e tickets de suporte em paralelo. As descobertas voltam ao contexto do agente líder, reduzindo o tempo de tarefas que antes seriam sequenciais.
Netflix, Harvey, Spiral e Wisedocs
A equipe de plataforma da Netflix usa multiagent orchestration para processar logs de centenas de builds e encontrar problemas recorrentes em aplicações. A Harvey elevou a taxa de conclusão em cerca de 6 vezes ao usar Dreaming para lembrar padrões de tool e tipos de arquivo. A Spiral combina Haiku, Opus e Outcomes para equilibrar custo e qualidade. A Wisedocs acelerou a revisão de documentos em 50%.
Outcomes como controle de qualidade
Outcomes usa uma rubrica de sucesso escrita pelo desenvolvedor e um grader independente que avalia apenas o resultado em contexto isolado. Se a saída falha, o agente recebe feedback e tenta de novo, por padrão três vezes e no máximo 20.
| Tipo de tarefa | Ganho de desempenho |
|---|---|
| Geração de docx | +8,4% |
| Geração de pptx | +10,1% |
Dreaming acumula memory, Outcomes garante qualidade e Multiagent Orchestration divide trabalho complexo. A combinação aponta para agentes empresariais capazes de executar tarefas reais com menos supervisão humana constante. Os números de Harvey, Wisedocs e Netflix indicam que a era da caixa de chat isolada está terminando.
Fontes: New in Claude Managed Agents: dreaming, outcomes, and multiagent orchestration (Claude Blog); Anthropic updates Claude Managed Agents with three new features (9to5Mac); CocoLoop; Claude's new "Dreaming" feature is designed to let AI agents learn from their mistakes (The Decoder); Anthropic just taught Claude to dream between tasks, and it makes agents meaningfully smarter (Digital Trends)