Anthropic 10 月 9 日更新 Claude 平台发布说明,动态工作流(dynamic workflows)以测试版进入 Claude Managed Agents。托管代理接到大任务时,可以自己写一个工作流:主代理拆解任务,分派给一批子代理分阶段执行,最后合并结果。单次运行最多并行协调 1000 个代理。
启用方式写在文档里:请求带上 managed-agents-2026-04-01 测试头,把代理的 multiagent 字段设为 multiagent_20261001 类型并打开工作流。工作流在服务器后台运行,调用方通过会话事件流里的 workflow_run 事件跟进度。
70 个 bug 的测试
Anthropic 给的例子是代码审查。团队在一个 11.6 万行的代码库里埋了 70 个 bug,让单个代理去找,每轮能找出 14 到 27 个,轮与轮之间波动不小;换成动态工作流,结果稳定在 66 个。
这组数字出自 Anthropic 自己的测试,任务类型也偏向容易拆分的一类:代码库可以按模块切开,每个子代理查一块,彼此依赖少。换成需要前后连贯推理的任务,比如一份长报告的论证链,拆分后的收益还剩多少,官方没有给出数据。科技媒体 The Decoder 也提醒,这个结论能否推广,得用户拿自己的工作负载去验证。
成本是另一处没有底的地方。Anthropic 在文档里提醒,这类工作流会消耗大量 token,建议从小规模开始。The Decoder 的报道里引了一位 OpenAI 资深工程师对代理集群的评价:
“a massive waste of tokens”(大量浪费 token)
测试版的计费细则、单次运行的 token 消耗区间,发布说明里都没有列出。
同一功能,两种跑法
动态工作流此前已经在 Claude Code 里上线,今年 5 月下旬以研究预览形式推出。拿两个版本对照,差别集中在三处:
- 脚本在哪跑:Claude Code 里,工作流脚本跑在用户自己的机器上;托管代理里,跑在 Anthropic 的服务器上。
- 谁来启动:Claude Code 的用户可以打开脚本、修改、重新运行;托管代理由代理自己判断什么时候启动工作流。
- 费用怎么管:据第三方开发者的对比说明,托管版按会话计费,可以给每个会话设上限。
Claude Managed Agents 是 Anthropic 今年 4 月推出的托管服务,面向需要连续跑几个小时以上的生产级代理,运行环境由 Anthropic 负责。这次把动态工作流搬上去,用户在自家产品里接入 Claude 代理时,不用自己搭编排层和并发调度,主代理拆任务、子代理执行、结果汇总都在服务端完成。
Claude Code 版更像开发者手边的工具,能看到每一步、随时改脚本;托管版更接近”交出去、等结果”。前者的可控性高,后者把运维挪给了 Anthropic,同时也把单次任务开多少代理、花多少 token 的决定权交了一部分给模型本身。企业用户最在意的那条,会话费用上限,具体怎么设、默认值多少,要等正式版文档。
目前功能仍是测试版,接口参数和字段名后续都可能调整。
参考来源:Claude 平台发布说明、The Decoder、CocoLoop、IT之家;核对代理并行上限、测试代码库规模与 bug 检出数量。