Zum Auftakt der Code with Claude SF am 6. Mai in San Francisco stellte Anthropic drei neue Funktionen für Managed Agents vor: Dreaming als Research Preview, Outcomes als Public Beta und Multiagent Orchestration ebenfalls als Public Beta. Im Mittelpunkt steht die Fähigkeit, komplexe Aufgaben auf mehrere Agenten zu verteilen.
Ein leitender Claude Agent kann Arbeit zerlegen und parallel an spezialisierte Subagenten geben. Jeder Subagent kann ein eigenes Modell, einen eigenen Prompt und eigene Werkzeuge nutzen.
20 Agenten, 25 Threads, ein Dateisystem
Anthropic nennt bis zu 20 unterschiedliche Agenten und bis zu 25 gleichzeitige Threads. Alle Subagenten teilen sich ein Dateisystem, Events werden dauerhaft gespeichert und der leitende Agent kann frühere Subagenten später wieder einbeziehen.
Bei einer Störungsanalyse könnten Subagenten parallel Deployment-Historie, Fehlerlogs, Monitoring-Metriken und Support-Tickets prüfen. Die Ergebnisse fließen zurück in den Kontext des leitenden Agenten. So kann Arbeit, die ein einzelner Agent sequenziell durch hunderte Logs erledigen müsste, deutlich schneller werden.
Netflix nutzt es bereits
Das Plattformteam von Netflix verwendet multiagent orchestration für einen Analyse-Agenten, der Logs aus hunderten Builds auswertet und wiederkehrende Problemklassen über Anwendungen hinweg findet. Harvey nutzt Dreaming, um Tool-Aufrufmuster und Dateiformat-Fallen in Dokumentenworkflows zu behalten, und steigerte die Abschlussrate um etwa das Sechsfache. Spiral kombiniert Haiku, Opus und Outcomes, während Wisedocs die Dokumentenprüfung um 50% beschleunigte.
Outcomes trennt Erzeugung und Bewertung
Bei Outcomes schreiben Entwickler eine Erfolgsrubrik. Ein unabhängiger Grader bewertet die Ausgabe in einem isolierten Kontext, ohne den Denkweg des Agenten zu sehen. Fällt das Ergebnis durch, wird Feedback zurückgegeben; Standard sind drei Wiederholungen, maximal 20.
| Aufgabe | Leistungsplus |
|---|---|
| docx-Dateien erzeugen | +8,4% |
| pptx-Dateien erzeugen | +10,1% |
Dreaming sammelt memory, Outcomes sichert Qualität und Multiagent Orchestration zerlegt komplexe Aufgaben. Zusammen zeigen sie eine Produktform, in der Unternehmensagenten echte Arbeit mit weniger ständiger menschlicher Aufsicht ausführen. Die Zahlen von Harvey, Wisedocs und Netflix deuten darauf hin, dass die Zeit des einzelnen Chatfensters endet.
Quellen: New in Claude Managed Agents: dreaming, outcomes, and multiagent orchestration (Claude Blog); Anthropic updates Claude Managed Agents with three new features (9to5Mac); CocoLoop; Claude's new "Dreaming" feature is designed to let AI agents learn from their mistakes (The Decoder); Anthropic just taught Claude to dream between tasks, and it makes agents meaningfully smarter (Digital Trends)