Tại Code with Claude SF ngày 6 tháng 5 theo giờ San Francisco, Anthropic giới thiệu ba tính năng mới cho Managed Agents: Dreaming ở giai đoạn nghiên cứu, Outcomes ở beta công khai và Multiagent Orchestration cũng ở beta công khai. Trọng tâm lần này là khả năng chia việc phức tạp cho nhiều agent.
Claude Agent giờ có thể để một agent dẫn dắt chia nhiệm vụ rồi giao cho các agent con chuyên trách chạy song song. Mỗi agent con có thể dùng model, prompt và bộ công cụ riêng.
20 agent, 25 luồng, một hệ thống tệp
Giới hạn của Anthropic là tối đa 20 agent khác nhau và tối đa 25 luồng đồng thời. Các agent con dùng chung hệ thống tệp, sự kiện được lưu bền vững và agent dẫn dắt có thể quay lại agent con trước đó để tiếp tục công việc.
Trong ví dụ điều tra sự cố, các agent con lần lượt kiểm tra lịch sử triển khai, log lỗi, chỉ số giám sát và ticket hỗ trợ, rồi gom kết quả về context của agent dẫn dắt. Công việc vốn phải đọc tuần tự hàng trăm log có thể được rút ngắn đáng kể.
Netflix đã sử dụng
Đội nền tảng Netflix dùng multiagent orchestration để phân tích log từ hàng trăm build và tìm các nhóm lỗi lặp lại trong nhiều ứng dụng. Harvey dùng Dreaming để nhớ mẫu gọi tool và lỗi theo loại tệp trong quy trình tài liệu, giúp tỷ lệ hoàn thành tăng khoảng 6 lần. Spiral kết hợp Haiku, Opus và Outcomes để cân bằng chi phí và chất lượng. Wisedocs tăng tốc kiểm tra chất lượng tài liệu 50% bằng outcome scoring.
Outcomes xử lý bài toán độ tin cậy
Outcomes cho phép nhà phát triển viết rubric thành công, rồi một grader độc lập chấm đầu ra trong context tách biệt. Grader chỉ nhìn kết quả, không xem quá trình suy luận. Nếu không đạt, agent nhận feedback và thử lại, mặc định 3 lần và tối đa 20 lần.
| Loại nhiệm vụ | Mức cải thiện |
|---|---|
| Tạo tệp docx | +8,4% |
| Tạo tệp pptx | +10,1% |
Dreaming tích lũy memory, Outcomes đảm bảo chất lượng, còn Multiagent Orchestration chia nhỏ nhiệm vụ phức tạp. Ba phần này tạo ra hình ảnh agent doanh nghiệp có thể tự chạy công việc thật. Các con số của Harvey, Wisedocs và Netflix cho thấy thời của một ô chat đơn lẻ đang khép lại.
Nguồn tham khảo: New in Claude Managed Agents: dreaming, outcomes, and multiagent orchestration (Claude Blog); Anthropic updates Claude Managed Agents with three new features (9to5Mac); CocoLoop; Claude's new "Dreaming" feature is designed to let AI agents learn from their mistakes (The Decoder); Anthropic just taught Claude to dream between tasks, and it makes agents meaningfully smarter (Digital Trends)