Qwen3.6 Plus d'Alibaba prend en charge 1M de contexte et rivalise avec Claude Opus

Alibaba Cloud a publié Qwen3.6 Plus début avril, positionné comme « IA agentique orientée entreprise ». Au milieu d'une avalanche d'annonces de grands modèles, cela peut sembler banal, mais en examinant les détails techniques et les benchmarks, plusieurs points méritent une attention particulière.

Contexte de 1M, conçu spécifiquement pour l'analyse de code au niveau du dépôt

La fenêtre de contexte de Qwen3.6 Plus est d'un million de tokens, soit environ 2000 pages de documents. Ce chiffre n'est pas nouveau, mais Alibaba a cette fois fourni un cas d'utilisation spécifique : l'analyse de code au niveau du dépôt.

Un dépôt de code complet, des dizaines de fichiers, des dizaines de milliers de lignes de code, le tout intégré dans le contexte, permettant au modèle de planifier, écrire, tester et réparer dans ce périmètre. Cette approche « sans découpage, sans récupération » réduit considérablement la complexité technique dans les tâches d'agent. L'exécution en terminal, la planification à longue chaîne et l'appel d'outils – ces trois capacités fondamentales des agents – ont été spécifiquement renforcées dans Qwen3.6 Plus.

À égalité avec Claude Opus 4.5 sur SWE-bench

Ce résultat de benchmark est le plus susceptible de susciter la controverse : Alibaba affirme que les performances de Qwen3.6 Plus sur SWE-bench Verified et Terminal-Bench 2.0 sont équivalentes à celles de Claude Opus 4.5 d'Anthropic.

BenchmarkQwen3.6 PlusClaude Opus 4.5
SWE-bench VerifiedÉquivalentBenchmark de référence
Terminal-Bench 2.0ÉquivalentBenchmark de référence

« Équivalent » est une déclaration du fabricant lui-même ; la vérification indépendante par des tiers est toujours en cours. Cependant, selon les évaluations de la communauté sur OpenRouter, la vitesse d'inférence de Qwen3.6 Plus Preview est environ 2 à 3 fois plus rapide que celle de Claude Opus 4.6, et le prix est bien inférieur : le prix d'entrée sur Alibaba Cloud est d'environ 0,29 USD par million de tokens.

Les évaluations de la communauté montrent que le score global et le classement de Qwen 3.6 Plus se sont considérablement améliorés par rapport à Qwen 3.5 Plus, et ce rythme d'évolution est réel.

Donnez-lui une capture d'écran, il écrit le code front-end pour vous

La partie multimodale mérite une mention spéciale : fournissez à Qwen3.6 Plus une capture d'écran d'interface utilisateur, un wireframe dessiné à la main ou un prototype de produit, et il peut générer directement le code front-end correspondant. Cela automatise directement l'étape « du design au code ». Combiné avec le contexte d'un million de tokens pour traiter des bibliothèques de composants complexes, la valeur pratique n'est pas négligeable.

Le modèle peut également effectuer un raisonnement multimodal sur des documents à haute densité, des environnements visuels et des vidéos longues. La capacité à relier les flux de travail de conception et de développement est l'une des principales orientations de cette version.

Intégration de Claude Code et Cline

En matière de support d'outils tiers, Qwen3.6 Plus est explicitement compatible avec Claude Code et Cline, deux outils de codage IA populaires. Avec la plateforme Wukong d'Alibaba Cloud – un système d'automatisation de processus métier multi-agents – il couvre essentiellement à la fois le côté entreprise et le côté développeur.

Alibaba a également indiqué qu'il publierait ultérieurement des versions plus petites en open source, mais sans préciser de calendrier.

Contexte de cette publication

Ce n'est pas seulement une mise à jour de modèle ; c'est un signal qu'Alibaba accélère le rythme des publications après avoir réorganisé son département IA en Token Hub. La pression concurrentielle est réelle : ByteDance Doubao et la série DeepSeek se disputent toutes le marché des entreprises, et Qwen3.6 Plus est une déclaration claire d'Alibaba dans la « course aux agents ».

Savoir s'il fonctionnera réellement de manière stable dans les environnements de production des grandes entreprises et quel sera le taux de réussite des tâches complexes – c'est ce qui doit être vérifié par la suite. Se fier uniquement aux scores des benchmarks ne suffit pas.

Source de référence : CocoLoop, Alibaba launches Qwen3.6-Plus for agentic AI and coding (techcoffeehouse.com) ; Alibaba Releases Qwen 3.6-Plus AI Model With Enhanced Coding Capabilities (Caixin Global) ; Qwen 3.6 Plus Review: Alibaba Frontier-Level Agentic Coding Model (MindStudio) ; Qwen 3.6 Plus Preview: 1M Context, Speed and Benchmarks 2026 (BuildFastWithAI)