アリババクラウドは4月初旬、Qwen 3.6 Plusをリリースした。同社はこれを「エンタープライズ向けAgentic AI」と位置づけている。数多くの大規模モデル発表の中では目立たないかもしれないが、技術詳細とベンチマーク結果には注目すべき点がある。
1Mコンテキスト、リポジトリレベルのコード分析向けに設計
Qwen 3.6 Plusのコンテキストウィンドウは100万トークンで、約2000ページの文書に相当する。この数字自体はもはや目新しいものではないが、アリババは今回、具体的なユースケースとしてリポジトリレベルのコード分析を提示した。
数十のファイル、数万行のコードからなる完全なコードリポジトリをコンテキストに収め、その範囲内でモデルがコードの計画、作成、テスト、修正を行う。この「チャンク分割も検索も不要」なアプローチは、エージェントタスクにおけるエンジニアリングの複雑さを大幅に軽減する。Qwen 3.6 Plusは、端末実行、長連鎖計画、ツール呼び出しといった中核的なエージェント機能についても強化が図られている。
SWE-benchでClaude Opus 4.5に匹敵
このベンチマーク結果が最も議論を呼ぶ可能性がある。アリババは、Qwen 3.6 PlusがSWE-bench VerifiedとTerminal-Bench 2.0において、AnthropicのClaude Opus 4.5と同等のパフォーマンスを発揮すると主張している。
| ベンチマーク | Qwen 3.6 Plus | Claude Opus 4.5 |
|---|---|---|
| SWE-bench Verified | 同等 | 参照基準 |
| Terminal-Bench 2.0 | 同等 | 参照基準 |
「同等」という主張はベンダー自身によるものであり、独立した第三者による検証はまだ進行中である。しかし、OpenRouterでのコミュニティ評価によれば、Qwen 3.6 Plus Previewの推論速度はClaude Opus 4.6の約2~3倍であり、価格ははるかに低い。アリババクラウド上の入力価格は約0.29ドル/100万トークンである。
コミュニティのベンチマークでは、Qwen 3.6 Plusの総合スコアとランキングがQwen 3.5 Plusから大幅に向上しており、この進化のペースは確かなものであることが示されている。
スクリーンショットを見せれば、フロントエンドコードを生成
マルチモーダル機能は特筆に値する。UIのスクリーンショット、手描きのワイヤーフレーム、製品プロトタイプを与えると、Qwen 3.6 Plusは対応するフロントエンドコードを直接生成できる。これにより「デザインからコードへ」のプロセスが自動化され、複雑なコンポーネントライブラリを処理する1Mコンテキストと組み合わせることで、実用的な価値は高い。
このモデルは、高密度ドキュメント、視覚環境、長尺動画にわたるマルチモーダル推論も実行できる。設計と開発のワークフロー間の橋渡し能力が、今回のリリースの主要な焦点の一つである。
Claude CodeとClineへの対応
サードパーティツールのサポートに関して、Qwen 3.6 Plusは主要なAIコーディングツールであるClaude CodeとClineに明示的に対応している。アリババクラウド独自のWukongプラットフォーム(ビジネスプロセスを自動化するマルチエージェントシステム)と組み合わせることで、エンタープライズ向けと開発者向けの両方をカバーする。
アリババはまた、将来的に小型バージョンをオープンソース化する意向を示しているが、具体的な時期は明らかにされていない。
今回のリリースの背景
これは単なるモデルアップデートではない。アリババがAI部門をToken Hubに再編した後、リリースペースを加速させるというシグナルである。競争圧力は現実のものだ。ByteDanceのDoubaoやDeepSeekシリーズが企業市場を争う中、Qwen 3.6 Plusは「エージェント領域」に対するアリババの明確な意思表明である。
大規模な本番環境で安定して動作するか、複雑なタスクの成功率をどの程度の水準で維持できるか——これこそが今後検証されるべき鍵であり、ベンチマークスコアだけでは十分ではない。
出典: CocoLoop、Alibaba launches Qwen3.6-Plus for agentic AI and coding(techcoffeehouse.com); Alibaba Releases Qwen 3.6-Plus AI Model With Enhanced Coding Capabilities(Caixin Global); Qwen 3.6 Plus Review: Alibaba Frontier-Level Agentic Coding Model(MindStudio); Qwen 3.6 Plus Preview: 1M Context, Speed and Benchmarks 2026(BuildFastWithAI)