Anthropic은 10월 9일 Claude 플랫폼 릴리스 노트를 업데이트하고, 동적 워크플로(dynamic workflows)가 베타 버전으로 Claude Managed Agents에 들어왔다고 밝혔다. 관리형 에이전트가 큰 작업을 받으면 스스로 워크플로를 작성할 수 있다. 메인 에이전트가 작업을 분해해 여러 서브에이전트에 단계별로 나눠 맡기고, 마지막에 결과를 합친다. 한 번 실행에 최대 1000개 에이전트를 병렬로 조율할 수 있다.
활성화 방법은 문서에 나와 있다. 요청에 managed-agents-2026-04-01 베타 헤더를 붙이고, 에이전트의 multiagent 필드를 multiagent_20261001 유형으로 설정한 뒤 워크플로를 켜면 된다. 워크플로는 서버 백그라운드에서 실행되며, 호출하는 쪽은 세션 이벤트 스트림의 workflow_run 이벤트로 진행 상황을 따라간다.
버그 70개 테스트
Anthropic이 든 예시는 코드 리뷰다. 팀은 11만 6000줄 규모의 코드베이스에 버그 70개를 심고 단일 에이전트에게 찾게 했다. 한 번에 14~27개를 찾았고, 회차마다 편차가 작지 않았다. 동적 워크플로로 바꾸자 결과는 66개로 안정적이었다.
이 수치는 Anthropic이 직접 한 테스트에서 나왔고, 작업 유형도 쪼개기 쉬운 쪽에 가깝다. 코드베이스는 모듈별로 나눌 수 있어 각 서브에이전트가 한 부분만 살피면 되고, 서로 의존하는 부분도 적다. 긴 보고서의 논증 흐름처럼 앞뒤가 이어지는 추론이 필요한 작업이라면 나눈 뒤에 이점이 얼마나 남는지에 대해서는 공식 데이터가 없다. 테크 매체 The Decoder도 이 결론을 일반화할 수 있을지는 사용자가 자신의 워크로드로 직접 검증해야 한다고 짚었다.
비용도 아직 바닥이 보이지 않는 부분이다. Anthropic은 문서에서 이런 워크플로가 토큰을 대량으로 소비하므로 작은 규모로 시작하라고 안내한다. The Decoder 보도는 에이전트 군집에 대한 OpenAI 시니어 엔지니어의 평가를 인용했다.
"a massive waste of tokens"(토큰의 막대한 낭비)
베타 버전의 과금 세부 내용이나 한 번 실행에 드는 토큰 소비 범위는 릴리스 노트에 나와 있지 않다.
같은 기능, 두 가지 실행 방식
동적 워크플로는 이미 Claude Code에서 먼저 나왔다. 올해 5월 하순 리서치 프리뷰로 공개된 기능이다. 두 버전을 비교하면 차이는 세 가지로 모인다.
- 스크립트가 도는 곳: Claude Code에서는 사용자 본인의 컴퓨터에서, 관리형 에이전트에서는 Anthropic 서버에서 돈다.
- 시작하는 주체: Claude Code 사용자는 스크립트를 열어 수정하고 다시 실행할 수 있다. 관리형 에이전트는 워크플로를 언제 시작할지 에이전트가 스스로 판단한다.
- 비용 관리: 서드파티 개발자의 비교 설명에 따르면 관리형 버전은 세션 단위로 과금하며 세션마다 한도를 둘 수 있다.
Claude Managed Agents는 Anthropic이 올해 4월 선보인 관리형 서비스로, 몇 시간 이상 연속으로 돌아가야 하는 프로덕션급 에이전트를 대상으로 하며 실행 환경은 Anthropic이 맡는다. 여기에 동적 워크플로가 올라가면서, 자사 제품에 Claude 에이전트를 붙이는 사용자는 오케스트레이션 계층이나 동시성 스케줄링을 직접 구축할 필요가 없어졌다. 메인 에이전트의 작업 분해, 서브에이전트의 실행, 결과 취합이 모두 서버 쪽에서 끝난다.
Claude Code 버전은 개발자 손안의 도구에 가까워 매 단계를 보면서 언제든 스크립트를 고칠 수 있다. 관리형 버전은 "맡기고 결과를 기다리는" 쪽에 더 가깝다. 앞쪽은 통제력이 높고, 뒤쪽은 운영 부담을 Anthropic으로 넘기는 대신 한 번의 작업에 에이전트를 몇 개 띄우고 토큰을 얼마나 쓸지에 대한 결정권 일부를 모델에 넘기게 된다. 기업 사용자가 가장 신경 쓰는 세션 비용 한도를 어떻게 설정하는지, 기본값이 얼마인지는 정식 버전 문서를 기다려야 한다.
현재 이 기능은 아직 베타 버전이며, 인터페이스 파라미터와 필드 이름은 이후 바뀔 수 있다.
참고 출처: Claude 플랫폼 릴리스 노트, The Decoder, CocoLoop, IT홈. 에이전트 병렬 상한, 테스트 코드베이스 규모, 버그 검출 수를 확인했다.