Năm nay, Alibaba đã phát hành toàn bộ dòng mô hình Qwen3 theo giấy phép Apache 2.0, từ 0,6B đến 235B với tổng cộng 8 kích thước, mở cửa hoàn toàn cho tất cả.
Tại sao giấy phép Apache lại quan trọng?
Apache 2.0 về cơ bản là một trong những giấy phép mã nguồn mở hào phóng nhất, nghĩa là doanh nghiệp có thể sử dụng thương mại miễn phí mà không cần đàm phán thêm về bản quyền. Trái lại, dòng Llama của Meta dù cũng tự xưng là "mã nguồn mở", nhưng thực chất chỉ là "trọng số mở" với nhiều hạn chế sử dụng. Mức độ cởi mở lần này của Alibaba được xem là triệt để nhất trong số các nhà sản xuất mô hình lớn trong nước.
Đặc điểm kỹ thuật
Thiết kế thú vị nhất của Qwen3 là chế độ suy luận lai — cùng một mô hình tích hợp cả chế độ thinking và non-thinking:
- Chế độ Thinking: Suy luận sâu, phù hợp cho toán học, mã code, phân tích logic
- Chế độ Non-thinking: Phản hồi nhanh, phù hợp cho hội thoại hàng ngày
Một mô hình xử lý được cả hai tình huống, không cần chuyển đổi giữa "mô hình suy luận" và "mô hình hội thoại", tối ưu hóa trực tiếp chi phí triển khai.
Điểm chuẩn
Qwen3-235B (MoE, kích hoạt 22B tham số) đạt kết quả cạnh tranh với DeepSeek R1 và GPT-4o trên nhiều benchmark. Về chi phí, nhờ kiến trúc MoE, chi phí suy luận thực tế chỉ tương đương một mô hình dense 22B.
Các phiên bản nhỏ hơn cũng gây bất ngờ — Qwen3-4B đạt kết quả ngang bằng với Qwen2.5-72B thế hệ trước trong nhiều tác vụ. Khoảng cách hơn bốn mươi lần về tham số đã bị xóa nhòa, mức tiến bộ này khá ấn tượng.
Chiến lược của Alibaba rất rõ ràng: dùng mã nguồn mở mạnh mẽ nhất để chiếm lĩnh hệ sinh thái. Nhà phát triển có thể dùng Qwen3 để thử nghiệm, xây dựng sản phẩm và thương mại hóa mà không gặp rào cản về bản quyền, sau đó khi hệ sinh thái phát triển, họ sẽ kiếm tiền từ dịch vụ đám mây. Cách làm này tương tự chiến lược Meta dùng Llama để mở rộng hệ sinh thái mã nguồn mở.
Nguồn tham khảo: Thông báo chính thức từ Alibaba Cloud, CocoLoop, Kho lưu trữ GitHub của Qwen