Há um número bastante interessante: no início de 2025, DeepSeek e Qwen juntos representavam menos de 1% do mercado global de IA; em janeiro de 2026, esse número havia subido para 15%.
Em um ano, de um participante marginal a uma posição que a indústria não pode ignorar, a velocidade é surpreendentemente rápida.
O que aconteceu nos bastidores merece ser analisado.
DeepSeek V4: O gigante de um trilhão de parâmetros
A versão completa do DeepSeek V4 ainda não foi lançada oficialmente ao público (até o início de abril), mas as notícias e os detalhes técnicos já são bem conhecidos.
Parâmetros principais: cerca de um trilhão de parâmetros totais, com aproximadamente 32 bilhões ativados por Token — a abordagem clássica da arquitetura de Mistura de Especialistas (MoE), com eficiência computacional muito superior a modelos Dense puros.
Alguns pontos de destaque:
Janela de contexto de até 1 milhão de Tokens. O V3 tinha 128K, desta vez é um salto de 8 vezes, capaz de processar uma base de código inteira ou um livro grosso de uma só vez. Para cenários que exigem análise de código entre arquivos ou processamento de documentos contratuais extremamente longos, essa mudança é substancial.
Multimodalidade nativa. Texto, imagem, vídeo, áudio, sem necessidade de camadas de adaptação adicionais, processamento unificado. Este design de arquitetura é muito mais limpo do que soluções que adicionam multimodalidade como remendo posterior.
Precificação: US$ 0,14/milhão de Tokens de entrada. Cerca de um vigésimo do GPT-5.
Um caso é bastante direto: uma empresa processa 50.000 documentos financeiros por dia. Com o GPT-5, o custo é de 12.000 dólares por mês; com o DeepSeek V4 na mesma precisão, apenas 600 dólares.
Qwen 3.5/3.6: Outra carta de Alibaba
Enquanto o DeepSeek V4 afiava suas lâminas, a Alibaba lançou várias novas versões do Qwen em rápida sucessão do final de março ao início de abril.
O Qwen3.5-Omni foi lançado em 1º de abril, e o Qwen3.6-Plus foi anunciado oficialmente em 2 de abril, com cerca de 39,7 bilhões de parâmetros ativos, janela de contexto de milhão de Tokens e cadeia de raciocínio integrada.
Principais diferenças em relação ao DeepSeek V4:
| DeepSeek V4 | Qwen 3.6-Plus | |
|---|---|---|
| Licença | DeepSeek License (com restrições) | Apache 2.0 |
| Suporte multilíngue | ~50 idiomas | 201 idiomas |
| Escala de parâmetros | ~1T total/32B ativos | 397B total/17B ativos |
| Custo de implantação empresarial | Baixo | Mais baixo |
O Apache 2.0 é um benefício real para as empresas — não é necessário contratar uma equipe jurídica para revisar a licença, o processo de implantação pode ser executado diretamente.
Além disso, o suporte a 201 idiomas é claramente atraente para empresas com operações no exterior e negócios em várias regiões.
A lógica de custo-benefício do código aberto já se estabeleceu
Sinceramente, se há um ano você dissesse a um tomador de decisão empresarial para substituir o GPT-4 por um modelo de código aberto, provavelmente seria visto como uma aventura. Agora, essa conversa mudou.
Algumas mudanças são reais:
A lacuna de capacidade está diminuindo. Em tarefas padrão como geração de código, processamento de documentos e análise de dados, o desempenho do DeepSeek V4 e do Qwen 3.5 está essencialmente no mesmo nível dos principais modelos fechados, superando-os em alguns benchmarks especializados.
A lacuna de preços continua aumentando. O preço da API do DeepSeek V4 é cerca de 5% do GPT-5, e o preço da série Qwen por meio de plataformas como SiliconFlow está na mesma faixa.
A capacidade de implantação melhorou. Ambos os modelos suportam implantação local, finalmente oferecendo uma opção confiável para requisitos de conformidade de dados que não podem sair do país.
É claro que o código aberto não é uma solução universal — para tarefas altamente especializadas (como áreas médicas, jurídicas) ou cenários que exigem atualização e manutenção contínuas, as vantagens dos modelos fechados permanecem. Mas para a grande maioria das aplicações cotidianas de IA, agora realmente vale a pena recalcular.
A próxima variável
Quando a versão completa do DeepSeek V4 será lançada é um dos lançamentos mais esperados do ano.
Se o desempenho da versão completa atender às expectativas, combinado com o preço incrível, a pressão sobre as séries GPT-5 e Claude Opus será muito direta.
A Anthropic, na semana passada, gerou reclamações de desenvolvedores devido a problemas com o OpenClaw. Neste momento, o campo do código aberto aumentando ainda mais sua competitividade é um timing bastante sutil.
Fontes de referência: CocoLoop, DeepSeek V4 and Qwen 3.5: Open-Source AI Is Rewriting the Rules in 2026 (Particula Tech), AI Updates Today (April 2026) – Latest AI Model Releases (llm-stats.com)