Qwen3.6 Plus của Alibaba hỗ trợ ngữ cảnh 1M token, sánh ngang Claude Opus

Alibaba Cloud đã phát hành Qwen3.6 Plus vào đầu tháng 4, được định vị là "AI tác nhân hướng đến doanh nghiệp". Trong số hàng loạt thông báo ra mắt mô hình lớn, điều này có vẻ bình thường, nhưng khi xem xét kỹ các chi tiết kỹ thuật và điểm chuẩn, có một số điểm đáng chú ý.

Ngữ cảnh 1M token, thiết kế riêng cho phân tích mã nguồn cấp kho lưu trữ

Cửa sổ ngữ cảnh của Qwen3.6 Plus là 1 triệu token, tương đương khoảng 2000 trang tài liệu. Con số này không còn mới, nhưng Alibaba lần này đưa ra một ứng dụng cụ thể: phân tích mã nguồn cấp kho lưu trữ.

Một kho lưu trữ mã hoàn chỉnh, hàng chục tệp, hàng chục nghìn dòng mã, tất cả được đưa vào ngữ cảnh, cho phép mô hình lập kế hoạch, viết, kiểm thử và sửa lỗi trong phạm vi đó. Cách tiếp cận "không cần phân đoạn, không cần truy xuất" này giúp giảm đáng kể độ phức tạp kỹ thuật trong các tác vụ tác nhân. Thực thi thiết bị đầu cuối, lập kế hoạch chuỗi dài và gọi công cụ – ba năng lực cốt lõi của tác nhân – đều được Qwen3.6 Plus tăng cường một cách có mục tiêu.

SWE-bench ngang bằng Claude Opus 4.5

Kết quả điểm chuẩn này là dễ gây tranh cãi nhất: Alibaba cho biết hiệu suất của Qwen3.6 Plus trên SWE-bench Verified và Terminal-Bench 2.0 tương đương với Claude Opus 4.5 của Anthropic.

Điểm chuẩnQwen3.6 PlusClaude Opus 4.5
SWE-bench VerifiedTương đươngĐiểm chuẩn tham chiếu
Terminal-Bench 2.0Tương đươngĐiểm chuẩn tham chiếu

"Tương đương" là tuyên bố từ chính nhà sản xuất; việc xác minh độc lập từ bên thứ ba vẫn đang được tiến hành. Tuy nhiên, theo đánh giá từ cộng đồng trên OpenRouter, tốc độ suy luận của Qwen3.6 Plus Preview nhanh hơn khoảng 2-3 lần so với Claude Opus 4.6, và giá thấp hơn nhiều: giá đầu vào trên Alibaba Cloud khoảng 0,29 USD/triệu token.

Các đánh giá từ cộng đồng cho thấy điểm tổng thể và thứ hạng của Qwen 3.6 Plus đã cải thiện đáng kể so với Qwen 3.5 Plus, và nhịp độ tiến hóa này là có thật.

Chụp ảnh màn hình, nó sẽ viết mã front-end cho bạn

Phần đa phương thức đáng được đề cập riêng: Đưa cho Qwen3.6 Plus một ảnh chụp màn hình UI, bản phác thảo tay hoặc nguyên mẫu sản phẩm, nó có thể trực tiếp tạo mã front-end tương ứng. Điều này tự động hóa trực tiếp bước "từ thiết kế đến mã", kết hợp với ngữ cảnh 1M token để xử lý các thư viện thành phần phức tạp, mang lại giá trị thực tiễn không nhỏ.

Mô hình cũng có thể suy luận đa phương thức trên các tài liệu mật độ cao, môi trường hình ảnh và video dài. Khả năng kết nối giữa quy trình thiết kế và phát triển là một trong những hướng chính của phiên bản này.

Tích hợp Claude Code và Cline

Về hỗ trợ công cụ bên thứ ba, Qwen3.6 Plus tương thích rõ ràng với Claude Code và Cline, hai công cụ lập trình AI phổ biến. Cùng với nền tảng Wukong của Alibaba Cloud – hệ thống tự động hóa quy trình kinh doanh đa tác nhân – về cơ bản bao phủ cả hướng doanh nghiệp và hướng nhà phát triển.

Alibaba cũng cho biết sẽ phát hành phiên bản nhỏ hơn dưới dạng mã nguồn mở sau này, nhưng không nêu rõ lịch trình cụ thể.

Bối cảnh của lần phát hành này

Đây không chỉ là một bản cập nhật mô hình; đó là tín hiệu cho thấy Alibaba đang tăng tốc độ phát hành sau khi tổ chức lại bộ phận AI thành Token Hub. Áp lực cạnh tranh là có thật: ByteDance Doubao và dòng DeepSeek đều đang tranh giành thị trường doanh nghiệp, và Qwen3.6 Plus là tuyên bố rõ ràng của Alibaba về "đường đua tác nhân".

Liệu nó có thực sự hoạt động ổn định trong môi trường sản xuất của các công ty lớn hay không, và tỷ lệ thành công của các tác vụ phức tạp có thể duy trì ở mức nào – đó mới là điều cần được xác minh sau này, chỉ dựa vào điểm chuẩn là chưa đủ.

Nguồn tham khảo: CocoLoop, Alibaba launches Qwen3.6-Plus for agentic AI and coding (techcoffeehouse.com); Alibaba Releases Qwen 3.6-Plus AI Model With Enhanced Coding Capabilities (Caixin Global); Qwen 3.6 Plus Review: Alibaba Frontier-Level Agentic Coding Model (MindStudio); Qwen 3.6 Plus Preview: 1M Context, Speed and Benchmarks 2026 (BuildFastWithAI)