Alibaba Cloud merilis Qwen 3.6 Plus pada awal April, dengan posisi resmi sebagai "Agentic AI untuk perusahaan." Di tengah banyaknya pengumuman model besar, detail teknis dan hasil tolok ukurnya patut dicermati.
Konteks 1M, Dirancang untuk Analisis Kode Tingkat Repositori
Qwen 3.6 Plus memiliki jendela konteks 1 juta token, setara dengan sekitar 2.000 halaman dokumen. Angka ini sebenarnya bukan hal baru, tetapi Alibaba kali ini memberikan kasus penggunaan yang lebih spesifik: analisis kode tingkat repositori.
Seluruh repositori kode—puluhan file, puluhan ribu baris kode—dimasukkan ke dalam konteks, memungkinkan model untuk merencanakan, menulis, menguji, dan memperbaiki kode dalam lingkup tersebut. Pendekatan "tanpa chunking, tanpa pencarian" ini secara signifikan mengurangi kompleksitas rekayasa dalam tugas agen. Qwen 3.6 Plus telah diperkuat secara khusus untuk kemampuan agen inti termasuk eksekusi terminal, perencanaan rantai panjang, dan pemanggilan alat.
Menyamai Claude Opus 4.5 pada SWE-bench
Hasil tolok ukur ini adalah yang paling mungkin memicu perdebatan: Alibaba mengklaim Qwen 3.6 Plus memiliki kinerja yang sebanding dengan Claude Opus 4.5 milik Anthropic pada SWE-bench Verified dan Terminal-Bench 2.0.
| Tolok Ukur | Qwen 3.6 Plus | Claude Opus 4.5 |
|---|---|---|
| SWE-bench Verified | Sebanding | Acuan dasar |
| Terminal-Bench 2.0 | Sebanding | Acuan dasar |
Klaim "sebanding" ini berasal dari vendor itu sendiri; verifikasi pihak ketiga yang independen masih berlangsung. Namun, dari evaluasi komunitas di OpenRouter, kecepatan inferensi Qwen 3.6 Plus Preview kira-kira 2-3 kali lipat dari Claude Opus 4.6, dengan harga yang jauh lebih rendah: harga input di Alibaba Cloud sekitar $0,29 per juta token.
Tolok ukur komunitas menunjukkan bahwa skor dan peringkat keseluruhan Qwen 3.6 Plus meningkat secara signifikan dibandingkan Qwen 3.5 Plus, mengonfirmasi laju evolusi ini.
Berikan Tangkapan Layar, Ia Menulis Kode Front-End
Kemampuan multimodal layak mendapat perhatian tersendiri: berikan Qwen 3.6 Plus tangkapan layar UI, wireframe gambar tangan, atau purwarupa produk, dan ia dapat langsung menghasilkan kode front-end yang sesuai. Ini mengotomatiskan jalur "dari desain ke kode," dan dikombinasikan dengan konteks 1M untuk menangani pustaka komponen yang kompleks, nilai praktisnya cukup besar.
Model ini juga dapat melakukan penalaran multimodal di seluruh dokumen kepadatan tinggi, lingkungan visual, dan video panjang. Kemampuan menjembatani alur kerja desain dan pengembangan menjadi salah satu fokus utama rilis ini.
Integrasi dengan Claude Code dan Cline
Dalam hal dukungan alat pihak ketiga, Qwen 3.6 Plus secara eksplisit mendukung Claude Code dan Cline, dua alat coding AI utama. Dikombinasikan dengan platform Wukong milik Alibaba Cloud sendiri—sistem multi-agen untuk mengotomatiskan proses bisnis—ini mencakup kebutuhan perusahaan dan pengembang.
Alibaba juga mengatakan akan merilis versi yang lebih kecil sebagai sumber terbuka di masa mendatang, meskipun jadwal spesifik belum diungkapkan.
Konteks Rilis Ini
Ini bukan sekadar pembaruan model. Ini adalah sinyal percepatan ritme rilis setelah Alibaba merestrukturisasi divisi AI-nya menjadi Token Hub. Tekanan persaingan nyata: Doubao dari ByteDance dan seri DeepSeek semuanya bersaing untuk pasar perusahaan. Qwen 3.6 Plus adalah pernyataan tegas Alibaba di "jalur agen."
Apakah ia dapat berjalan stabil di lingkungan produksi skala besar dan mempertahankan tingkat keberhasilan yang konsisten pada tugas-tugas kompleks—itulah kunci yang perlu diverifikasi ke depannya. Skor tolok ukur saja tidak cukup.
Sumber: CocoLoop, Alibaba launches Qwen3.6-Plus for agentic AI and coding (techcoffeehouse.com); Alibaba Releases Qwen 3.6-Plus AI Model With Enhanced Coding Capabilities (Caixin Global); Qwen 3.6 Plus Review: Alibaba Frontier-Level Agentic Coding Model (MindStudio); Qwen 3.6 Plus Preview: 1M Context, Speed and Benchmarks 2026 (BuildFastWithAI)