Qwen3.8-Max đã rời giai đoạn hứa hẹn để bước vào kho mô hình thật. Ngày 12 tháng 8, trang ModelScope Qwen/Qwen3.8-2.4T-A95B ghi rằng kho này chứa trọng số hậu huấn luyện và tệp cấu hình ở định dạng Hugging Face Transformers.
Thẻ mô hình nêu khả năng tương thích với vLLM, SGLang và TokenSpeed. Metadata của ModelScope cho thấy dung lượng lưu trữ khoảng 4,89TB. Qwen3.8-Max từng được đưa vào Qoder và Token Plan; điểm mới lần này là một mô hình cấp Max đã có trọng số mở.
Trọng số là điểm kiểm chứng mới
“This repository contains model weights and configuration files for the post-trained model in the Hugging Face Transformers format.”
Các thông số chính gồm 2,4T tham số tổng, 95B tham số kích hoạt, ngữ cảnh gốc 262.144 token và khả năng mở rộng tới 1.010.000 token. Kiến trúc gồm 92 lớp, 512 chuyên gia, 10 routed experts cộng một shared expert, và vốn từ 248.320 token.
Mô hình ModelScope khác với dịch vụ Qwen3.8-Max trên Qwen Cloud. Bản open-weight chỉ hỗ trợ văn bản và bắt buộc thinking mode, trong khi dịch vụ cloud có thêm đầu vào thị giác, chế độ không suy luận, ngữ cảnh mặc định 1M và công cụ tích hợp.
Giá trị nằm ở quyền kiểm soát
Với đội ngũ phát triển, giảm giá API khác với mở trọng số. Ưu đãi có thể hết hạn; trọng số cho phép thử engine suy luận, lượng tử hóa, kho mã nội bộ, tài liệu dài và phân tách quyền trong môi trường riêng.
Dung lượng 4,89TB cũng đặt giới hạn rõ ràng. Đây không phải mô hình chạy dễ trên laptop. Phần lớn người dùng sẽ tiếp cận qua dịch vụ hosted, bản lượng tử hóa hoặc cụm doanh nghiệp. Giá trị của việc mở là tạo điều kiện cho tái lập và tối ưu độc lập.
Bảng chính thức nêu Terminal Bench 2.1 đạt 86,6, SWE-bench Pro 67,7, PaperBench 93,0 và OSWorld-Verified 86,1. Nhưng harness, timeout, độ dài ngữ cảnh và nguồn baseline khác nhau giữa các bài thử. Các mốc cần kiểm tiếp theo là giấy phép, tải xuống ổn định, recipe vLLM và SGLang, benchmark bên thứ ba và hiệu năng sau lượng tử hóa.
Nguồn: thẻ mô hình ModelScope Qwen3.8-2.4T-A95B, blog chính thức Qwen3.8-Max, tài liệu mô hình Qwen Cloud, DataCamp, CocoLoop; kiểm chứng trạng thái open-weight, dung lượng kho, tổng tham số và tham số kích hoạt, độ dài ngữ cảnh, tương thích framework, giới hạn thinking mode, điểm benchmark và khác biệt API quản lý.