Google lança Nano Banana 2.1, versão antiga será desativada no fim do mês

Em 6 de outubro, o Google DeepMind lançou o modelo de imagem Nano Banana 2.1, que no mesmo dia passou a estar oficialmente disponível na Gemini API, com o ID de modelo gemini-nano-banana-2.1. É a versão atualizada do Nano Banana 2 (nome de interface gemini-3.1-flash-image), cuja interface antiga será desativada em 29 de outubro.

Segundo o model card oficial, o Nano Banana 2.1 pertence à série Gemini 3, tem como base o Gemini 3.6 Flash e é, em si, um modelo de raciocínio multimodal nativo. A entrada aceita texto e imagens, com janela de contexto de até 1 milhão de tokens; a saída pode ser uma imagem ou texto com até 64 mil tokens.

O que mudou

O changelog da API lista quatro melhorias: qualidade de imagem, aderência ao prompt, consistência de personagens em diálogos de múltiplas rodadas e renderização de texto. A novidade são proporções ultra largas, com quatro formatos — 1:4, 4:1, 1:8 e 8:1 — e resoluções selecionáveis de 1K, 2K e 4K. Segundo o Google, velocidade e custo permanecem no nível do Flash.

O model card traz dois conjuntos de números comparativos:

  • Na pontuação geral de preferência humana para geração de imagem a partir de texto, a versão Thinking do Nano Banana 2.1 obteve 1050 (±14), contra 990 (±7) do Nano Banana 2;
  • A precisão factual em infográficos subiu de 0,179 para 0,521.

Esse último aumento é de quase três vezes. Infográficos exigem que o modelo não só desenhe corretamente, mas também acerte números e rótulos, ponto em que modelos de geração de imagem costumavam falhar mais. 0,521 ainda significa que quase metade dos infográficos tem problemas factuais, por isso materiais oficiais ainda exigem revisão manual.

As limitações admitidas pelo próprio Google

O model card lista algumas limitações conhecidas: renderização de texto ruim em fontes pequenas e parágrafos longos; consistência de personagens entre entrada e saída não garantida; raciocínio espacial limitado, com confusões ocasionais entre direções como esquerda e direita. Quanto ao corte de conhecimento, em algumas áreas chega a março de 2026, em outras apenas a janeiro de 2025.

Na parte de segurança, o model card afirma que o modelo passou o limiar de segurança infantil para lançamento, que a equipe de red team dedicada não encontrou problemas graves e que, na avaliação de segurança de fronteira, não atingiu nenhum nível de capacidade que exigisse monitoramento ou fosse considerado crítico.

Onde já está integrado

Além do Gemini App, Google AI Studio e Gemini API, o Nano Banana 2.1 também foi integrado ao AI Mode da Busca, ao Google Ads, à ferramenta de vídeo Flow e à ferramenta de design Stitch. As integrações em anúncios e busca indicam que o Google pretende usá-lo diretamente para geração em massa de material comercial.

Para desenvolvedores na China continental

A Gemini API não pode ser acessada diretamente na China continental, e a maioria das equipes locais a utiliza por meio de nuvens estrangeiras ou plataformas agregadoras de terceiros. Com a interface antiga sendo desativada em 23 dias, o ponto mais propenso a problemas é se essas plataformas conseguirão migrar a tempo o mapeamento de modelos; equipes que executam tarefas de produção com gemini-3.1-flash-image devem trocar para o novo ID em ambiente de teste já nesta semana.

Há ainda outro ponto a observar para cenários em chinês. O model card lista a renderização ruim de texto em fontes pequenas como limitação, e os caracteres chineses, com traços densos, tendem a borrar mais facilmente do que o texto em latim no mesmo tamanho de fonte; em pôsteres e imagens principais de e-commerce, títulos grandes não são um problema, mas textos pequenos ainda podem precisar de retoque posterior. O Google ainda não publicou dados de avaliação específicos para a renderização em chinês.

O changelog também não informa o preço do novo modelo, e o Google ainda não esclareceu se manterá a tabela de cobrança do Nano Banana 2.

Fontes: CocoLoop, model card do Google DeepMind, changelog da Gemini API; a pontuação de preferência e a precisão de infográficos seguem os resultados publicados no model card, e o cronograma de desativação segue o changelog da Gemini API.