Ngày 27 tháng 1 năm nay, Moonshot AI đã phát hành Kimi K2.5 – bổ sung khả năng đa phương thức gốc và tính năng Agent Swarm dựa trên nền tảng K2.
Agent Swarm là gì
Ý tưởng cốt lõi: chia một tác vụ phức tạp thành nhiều tác vụ con, mỗi tác vụ con được giao cho một agent độc lập thực thi song song.
Ví dụ – nếu bạn yêu cầu một agent "phân tích chất lượng mã của 100 kho GitHub này":
- Cách truyền thống: một agent lần lượt phân tích 100 kho, thực thi tuần tự
- Agent Swarm: chia ra 100 agent con cùng lúc làm việc, tổng hợp kết quả
Thiết kế này trực tiếp giải quyết nút thắt lớn nhất trong kịch bản agent – tốc độ. Một agent dù mạnh đến đâu cũng chỉ thực thi tuần tự.
Khả năng đa phương thức
K2.5 được tiếp tục tiền huấn luyện trên nền tảng K2-Base với khoảng 15 nghìn tỷ token hỗn hợp thị giác và văn bản, đạt được khả năng hiểu đa phương thức gốc.
Điều này có nghĩa K2.5 không chỉ đơn thuần "xem ảnh" – khả năng hiểu nội dung hình ảnh được học ngay trong giai đoạn tiền huấn luyện, chứ không phải ghép adapter vào sau. Đa phương thức gốc thường có chất lượng hiểu cao hơn các giải pháp ghép nối sau.
Chiến lược mã nguồn mở
Giống như K2, K2.5 cũng đi theo hướng mở. Có thể tải về trên Hugging Face. Moonshot AI tỏ ra khá quyết liệt trong việc mã nguồn mở – mô hình nghìn tỷ tham số mã nguồn mở, mô hình đa phương thức mã nguồn mở, hầu như không giữ lại gì.
Vị thế trong bối cảnh cạnh tranh
So với Agent Teams của Claude Code và Copilot Cowork của Microsoft, Agent Swarm nhấn mạnh hơn vào song song hóa quy mô lớn thay vì cộng tác đa vai trò. Trọng tâm khác nhau.
Trên đường đua AI Agent trong nước, Moonshot AI, Zhipu, Alibaba và ByteDance đều đang tự tiến bước. Agent Swarm của Kimi K2.5 hiện là một trong những giải pháp đa agent song song rõ ràng nhất.
Nguồn tham khảo: CocoLoop, thông báo chính thức từ Moonshot AI