Le 6 octobre, Google DeepMind a lancé le modèle d'image Nano Banana 2.1, disponible officiellement le même jour dans l'API Gemini, sous l'identifiant de modèle gemini-nano-banana-2.1. Il s'agit de la version mise à jour de Nano Banana 2 (nom d'interface gemini-3.1-flash-image), dont l'ancienne interface sera désactivée le 29 octobre.
Selon la fiche de modèle officielle, Nano Banana 2.1 appartient à la série Gemini 3, repose sur Gemini 3.6 Flash et constitue lui-même un modèle de raisonnement nativement multimodal. L'entrée accepte texte et images, avec une fenêtre de contexte allant jusqu'à 1 million de tokens ; la sortie peut être une image ou un texte allant jusqu'à 64 000 tokens.
Ce qui a changé
Le journal des modifications de l'API énumère quatre améliorations : la qualité d'image, le respect des consignes, la cohérence des personnages sur plusieurs tours de dialogue, et le rendu du texte. La nouveauté réside dans les formats ultra larges, avec quatre ratios — 1:4, 4:1, 1:8 et 8:1 — et des résolutions au choix parmi 1K, 2K et 4K. Google indique que la vitesse et le coût restent au niveau de Flash.
La fiche de modèle fournit deux séries de chiffres comparatifs :
- Sur le score global de préférence humaine pour la génération d'image à partir de texte, la version Thinking de Nano Banana 2.1 obtient 1050 (±14), contre 990 (±7) pour Nano Banana 2 ;
- La précision factuelle des infographies est passée de 0,179 à 0,521.
Cette dernière hausse représente près du triple. Les infographies exigent que le modèle non seulement dessine correctement, mais aussi restitue des chiffres et des légendes exacts, un point où les modèles de génération d'image se trompaient le plus souvent jusqu'ici. 0,521 signifie néanmoins que près de la moitié des infographies comportent encore des erreurs factuelles ; pour un usage officiel, une vérification manuelle reste donc nécessaire.
Les faiblesses reconnues par Google lui-même
La fiche de modèle liste plusieurs limites connues : un rendu de texte médiocre pour les petites polices et les longs paragraphes ; une cohérence des personnages entre l'entrée et la sortie non garantie ; un raisonnement spatial limité, avec parfois une confusion entre des directions comme la gauche et la droite. Côté date limite des connaissances, certains domaines vont jusqu'à mars 2026, d'autres seulement jusqu'à janvier 2025.
Sur le plan de la sécurité, la fiche de modèle indique qu'il a franchi le seuil de sécurité pour les enfants requis pour son lancement, que l'équipe de red team dédiée n'a relevé aucun problème grave, et que l'évaluation de sécurité de pointe n'a mis en évidence aucun niveau de capacité nécessitant une surveillance ou jugé critique.
Où il a été intégré
Au-delà de Gemini App, Google AI Studio et l'API Gemini, Nano Banana 2.1 a également été intégré au mode IA de la Recherche, à Google Ads, à l'outil vidéo Flow et à l'outil de conception Stitch. Ces deux points d'entrée, publicité et recherche, montrent que Google prévoit de l'utiliser directement pour la génération en masse de supports commerciaux.
Pour les développeurs en Chine continentale
L'API Gemini n'est pas accessible directement depuis la Chine continentale, et la plupart des équipes locales y accèdent via des clouds étrangers ou des plateformes d'agrégation tierces. Avec l'ancienne interface désactivée dans 23 jours, le point le plus sensible est de savoir si ces plateformes parviendront à basculer à temps leur correspondance de modèles ; les équipes exploitant gemini-3.1-flash-image en production devraient passer au nouvel identifiant dans leur environnement de test dès cette semaine.
Pour le contexte en chinois, un autre point mérite attention. La fiche de modèle cite le mauvais rendu du texte en petite police comme une limite, et les caractères chinois, aux traits denses, ont tendance à devenir flous plus facilement que le texte latin à la même taille de police ; pour les affiches et les visuels principaux d'e-commerce, les grands titres ne posent pas de problème, mais les textes en petite taille pourraient encore nécessiter une retouche ultérieure. Google n'a pour l'instant publié aucune donnée d'évaluation spécifique pour le rendu en chinois.
Le journal des modifications ne précise pas non plus le prix du nouveau modèle, et Google n'a pas encore indiqué s'il reprendra la grille tarifaire de Nano Banana 2.
Sources : CocoLoop, fiche de modèle de Google DeepMind, journal des modifications de l'API Gemini ; le score de préférence et la précision des infographies se fondent sur les résultats publiés dans la fiche de modèle, et le calendrier de désactivation suit le journal des modifications de l'API Gemini.