Qwen3.6-Max da Alibaba lidera 6 testes e torna-se código fechado

Em 20 de abril, a Alibaba lançou o Qwen3.6-Max-Preview, o modelo mais poderoso já produzido na série Qwen.

Diz-se "silenciosamente" porque desta vez não houve uma grande celebração de código aberto, nenhum anúncio de protocolo Apache e nenhuma faixa de boas-vindas para download comercial gratuito. O Qwen3.6-Max está acessível apenas através do Qwen Studio e da API Model Studio da Alibaba Cloud; os pesos não são divulgados publicamente.

Este é um ponto de viragem na estratégia de IA da Alibaba que merece atenção.

Os números falam: 6 primeiros lugares, 2º lugar geral

Primeiro, vejamos os resultados. O Qwen3.6-Max alcançou o primeiro lugar nos seguintes 6 benchmarks principais:

TesteConteúdo avaliado
SWE-bench ProTarefas reais de engenharia de software
Terminal-Bench 2.0Capacidade de execução de linha de comando
SkillsBenchResolução geral de problemas
QwenClawBenchChamada de ferramentas
QwenWebBenchInteração web
SciCodeProgramação científica

Após avaliação independente, a Artificial Analysis classificou-o em 2º lugar geral—apenas atrás do Muse Spark da Meta e muito acima da mediana de outros modelos de raciocínio na mesma faixa de preço.

Comparado à geração anterior Qwen3.6-Plus, a versão Max melhora 2,3% no SuperGPQA (raciocínio combinado de alta dificuldade) e 5,3% no teste de língua chinesa QwenChineseBench. Estes são progressos reais, não uma troca de testes para aumentar a pontuação.

Especificações técnicas

Janela de contexto: 256k tokens. Note que isto é muito menor do que a janela de 1 milhão de tokens do Qwen3.6-Plus—a Alibaba fez uma troca aqui, usando uma janela mais curta para obter maior qualidade de raciocínio.

Formato de entrada: Atualmente suporta apenas texto, não imagens. Isto é um pouco surpreendente para um modelo mais poderoso, mas a versão Preview provavelmente adicionará isso mais tarde.

Compatibilidade de API: Compatível simultaneamente com as especificações de API da OpenAI e da Anthropic, com custos de migração muito baixos.

Preserve_thinking: Esta é uma nova funcionalidade digna de nota—o modelo pode transmitir vestígios de raciocínio através de múltiplas rodadas de conversa. Ele lembra como pensou anteriormente, em vez de começar o raciocínio do zero a cada vez. Útil para cenários que exigem processos longos e interações de múltiplas etapas.

Questão chave: Por que um gigante do código aberto fechou subitamente o seu modelo principal?

A série Qwen seguiu anteriormente o caminho típico do código aberto. O Qwen3 usou o protocolo Apache, o Qwen3.6-35B-A3B foi aberto em 16 de abril, incluindo a divulgação dos pesos.

Mas o Max desta vez é diferente.

A Alibaba não é a primeira a seguir este caminho:

  • A Meta construiu um ecossistema de desenvolvedores com o Llama (código aberto) e depois lançou o Muse Spark, o primeiro modelo principal de código fechado do seu laboratório de superinteligência
  • Agora a Alibaba também está a traçar uma linha no seu ponto mais forte

A lógica por trás disso não é difícil de entender. O código aberto é adequado para conquistar mercado e construir um ecossistema, fazendo com que os desenvolvedores fiquem do seu lado; mas os modelos de topo são os verdadeiros ativos que podem negociar com grandes clientes e cobrar taxas de serviço. Abrir modelos pequenos, cobrar por modelos grandes—esta tornou-se a estratégia dominante em 2026.

Na verdade, toda a indústria está a mover-se nesta direção: OpenAI com modelo principal de código fechado, Meta com Muse Spark de código fechado, Alibaba com Max de código fechado. Os únicos que ainda insistem na abertura total são principalmente laboratórios de investigação de média e pequena escala e alguns projetos com filosofias claras.

O que isto significa para os programadores

Boas notícias: A API é compatível com as interfaces da OpenAI e da Anthropic; se já estiver a usar uma delas, a mudança quase não requer alterações de código.

Más notícias: Não é possível a implementação local. Para cenários com elevados requisitos de privacidade de dados, baixa latência ou necessidade de funcionamento offline, o Max não é uma opção. Nestes casos, continue a considerar o Qwen3.6-35B-A3B.

Notícias neutras: O contexto de 256k é suficiente para a maioria das tarefas práticas. A janela de 1 milhão de tokens é impressionante, mas não há muitos cenários que a utilizem realmente ao máximo. O Max concentra recursos na qualidade do raciocínio, uma troca razoável.

O que vem a seguir

Atualmente, o Max-Preview está em estado de Preview. Por norma:

  • O suporte a imagens será adicionado na versão oficial
  • A estratégia de preços ainda não foi anunciada; não há preços na fase de teste público
  • O ecossistema de modelos pequenos de código aberto (35B-A3B, etc.) continuará a ser mantido e não será interrompido

A abordagem da Alibaba à IA está a mudar da construção de um ecossistema de rede ampla para atrair utilizadores com código aberto e rentabilizar com código fechado. Esta estratégia é quase inevitável no mercado de IA de 2026—porque depois de o código aberto puro atingir uma certa escala, o caminho de comercialização torna-se muito estreito.

Para os programadores que escolheram o Qwen por causa do código aberto, esta mudança merece atenção. O modelo principal fechou, mas os modelos pequenos ainda existem. Como usá-los depende do seu cenário.

Fonte de referência: CocoLoop, Alibaba Drops Qwen 3.6 Max Preview—Its Most Powerful Model Yet (Decrypt)