A equipe do LongCat, da Meituan, lançou em 25 de setembro o LongCat-2.5-Preview em sua própria plataforma de API aberta. É a geração seguinte ao LongCat-2.0, que ganhou código aberto no fim de junho, e a Meituan posiciona o novo modelo em torno de duas palavras-chave: tarefas de longo alcance e multimodalidade.
Um dia depois, a ferramenta de programação de código aberto OpenCode anunciou que passaria a oferecer o LongCat-2.5-Preview gratuitamente por duas semanas, com garantia de retenção zero de dados.
Parâmetros iguais, mas agora com 'olhos'
O LongCat-2.5-Preview mantém a arquitetura de mistura de especialistas (MoE), com cerca de 1,6 trilhão de parâmetros no total e aproximadamente 48 bilhões ativados a cada inferência — na mesma faixa da versão 2.0. O modelo suporta nativamente contexto de 1 milhão de tokens, com saída máxima de 128K tokens por chamada.
As mudanças se concentram em dois pontos. Primeiro, a adição de compreensão de imagens, permitindo analisar conteúdo visual para responder perguntas multimodais, resumir conteúdo e fazer raciocínio visual. Segundo, o foco em tarefas de 'fluxo longo': a Meituan lista cenários como terminal, navegador, softwares de desktop, planilhas e ferramentas de design — ou seja, fazer o modelo operar continuamente em várias interfaces dentro de uma mesma tarefa.
A capacidade de programação é o destaque da divulgação. A Meituan afirma que o modelo se sobressai em geração de código, compreensão de código e tarefas de programação automatizada, além de ser compatível com ferramentas populares como Claude Code, OpenCode, OpenClaw, Hermes e Kilo Code. A interface de API suporta simultaneamente os formatos da OpenAI e da Anthropic.
Até o momento, a Meituan não divulgou nenhuma pontuação de benchmark, então não se sabe o quanto a operação em GUI e as tarefas de fluxo longo evoluíram em relação à versão 2.0 — por ora, não há dados externos para comparação. Esta versão leva o nome Preview, e a Meituan também não informou se disponibilizará os pesos em código aberto como fez com a 2.0.
O que isso significa para desenvolvedores chineses
O ponto mais imediato é o baixo custo de integração. Como a interface é compatível com o formato da Anthropic, desenvolvedores acostumados com o Claude Code podem simplesmente trocar o endereço da API e a chave de acesso para migrar o modelo de back-end para o LongCat, sem precisar reescrever o fluxo de trabalho. Para equipes com dificuldade de acessar modelos estrangeiros a partir da China, isso representa mais uma opção de back-end pronta para uso.
Em relação a preços, a Meituan concedeu aos usuários existentes uma cota gratuita de 5 milhões de tokens. A tabela oficial de preços ainda não foi divulgada, e ainda não está claro se o preço da fase Preview será mantido após o lançamento oficial.
A combinação de contexto longo com fluxos longos mira trabalhos em nível de repositório de código. 1 milhão de tokens é suficiente, em linhas gerais, para comportar o código-fonte principal de um projeto de médio porte, permitindo que o modelo leia tudo de uma vez antes de começar a editar, o que poupa boa parte do trabalho de costurar contexto em pedaços. Já quanto tempo o modelo consegue manter operações de múltiplas etapas sem perder o rumo, só será possível saber com testes reais dos desenvolvedores.
De Owl Alpha a 2.5
O caminho percorrido pelo LongCat pode ser rastreado. Antes do lançamento em código aberto da versão 2.0, o modelo já estava disponível de forma anônima e gratuita no OpenRouter sob o codinome Owl Alpha, chegando a liderar o volume de chamadas na plataforma; só depois de revelada sua identidade é que foi liberado como código aberto sob licença MIT. A Meituan afirma que tanto o treinamento quanto a inferência rodam em clusters de chips nacionais.
Com o 2.5-Preview, a Meituan repete a estratégia de liberar grátis primeiro e definir o preço depois: a própria plataforma distribui cota de teste, enquanto a ferramenta estrangeira oferece duas semanas de acesso gratuito. O volume real de uso e o feedback dos desenvolvedores durante essas duas semanas no OpenCode devem influenciar bastante o preço final.
Fontes: Plataforma de API aberta LongCat da Meituan, ITHome, conta oficial do OpenCode, CocoLoop; foram verificados o total de 1,6 trilhão de parâmetros, cerca de 48 bilhões de parâmetros ativos, contexto de 1 milhão de tokens, saída máxima de 128K e a cota de teste de 5 milhões de tokens.