DeepSeek lança teste do V4.1 Flash, que expira em 10 de setembro

A DeepSeek abriu um teste de uma versão intermediária do DeepSeek V4.1 Flash. Segundo a descrição oficial, esta versão usa uma nova arquitetura de modelo, suporta multimodalidade nativa e é mais capaz, mais rápida e mais barata.

O acesso praticamente não tem barreiras: a base_url permanece a mesma, bastando trocar o nome do modelo para deepseek-v4.1-flash-expires-on-0910 para chamá-lo. A cobrança é idêntica à do deepseek-v4-flash, com limite de 20 chamadas simultâneas por conta. O número 0910 no nome é a data de validade — após 10 de setembro, esse identificador de modelo deixa de funcionar.

A multimodalidade nativa é o foco desta mudança

Antes, para processar entradas mistas de imagem e texto, a série Flash precisava de um pacote de extensão visual adicional. Nesta versão, essa capacidade foi incorporada diretamente ao próprio modelo.

A diferença não é apenas deixar de instalar um pacote. No método do pacote de extensão, a imagem geralmente passa primeiro por um codificador separado antes de ser encaixada na sequência de texto — essa etapa intermediária consome tanto latência quanto precisão. Multimodalidade nativa significa que imagem e texto são treinados e processados na mesma arquitetura. Para a linha Flash, cujo foco principal é a baixa latência, esse é um ajuste de direção — o objetivo não é elevar o teto da compreensão visual, mas sim não pagar latência extra pela multimodalidade.

Em termos de posicionamento, o V4.1 Flash fica entre o V4 Flash e o V4 Pro existentes: arquitetura atualizada, com multimodalidade nativa, mantendo a característica de baixa latência que sempre marcou a série Flash.

A prática de embutir a data de expiração no nome do modelo

Essa nomenclatura não é inédita, mas usada numa “versão intermediária” carrega mais informação do que o próprio anúncio.

Um identificador de modelo com data de expiração significa que quem o integra precisa concluir a avaliação em dois dias e já sabe que terá de removê-lo depois. Isso exclui qualquer uso em produção, restando basicamente um único propósito: coletar dados de desempenho dessa nova arquitetura sob tráfego real. A janela de 48 horas e o limite de 20 chamadas simultâneas por conta enquadram isso como um teste de carga, não como um lançamento.

Para os desenvolvedores chineses, o que dá para avaliar é limitado. O tamanho de parâmetros, as mudanças no comprimento de contexto e os dados de avaliação não foram divulgados oficialmente; também não há informação sobre o cronograma da versão oficial do V4.1 nem se essa nova arquitetura chegará também ao nível Pro. A alegação de “mais rápido e mais barato” vem, por ora, apenas do lado do fornecedor, sem verificação externa possível. A única coisa que dá para confirmar por conta própria é que o preço não mudou: pelo mesmo valor, rodando por dois dias.

Vale comparar com o ritmo anterior desta linha de produtos. O caminho do V4-Flash, da prévia até a abertura oficial da API, o preço promocional do V4-Pro que virou preço de tabela permanente, e a adição de tarifa dobrada em horário de pico na API — tudo isso aconteceu em poucos meses. A DeepSeek normalmente não dá avisos longos sobre iterações de versão, e desta vez nem sequer apresentou um cronograma para a versão oficial.

Fontes: comunicado da DeepSeek Open Platform, IT之家 (IT Home), CocoLoop, 澎湃新闻 (The Paper); o identificador do modelo, a cobrança e o limite de concorrência seguem o comunicado oficial de teste, o tamanho de parâmetros e os dados de avaliação não foram divulgados pelo fornecedor.