Le tout dernier modèle d’image polyvalent de Google, intégré la semaine même de sa sortie : meilleure édition basée sur les masques et cohérence du sujet, sortie 4K, et environ la moitié du prix du modèle qu’il remplace.
Développeur
Google DeepMind
Publié
6 oct. 2026
Base
Gemini 3.6 Flash
ID API
gemini-nano-banana-2.1
Sortie
Jusqu’à 4K · ratios jusqu’à 8:1
Références
Jusqu’à 14 images
Réflexion
Minimal · moyen · élevé
Notre verdict en une ligne : la nouvelle référence. Une meilleure édition, des cadres plus larges et la 4K pour environ la moitié du prix du précédent — et le modèle que Google recommande elle-même pour remplacer Nano Banana 2.
Nano Banana 2.1 est arrivé le 6 octobre comme une mise à niveau directe du modèle qui était celui par défaut de Google depuis février, et le point marquant est inhabituel : il est meilleur et coûte environ deux fois moins cher. Google fait état de progrès en matière de conception visuelle, d’édition basée sur des masques, de cohérence des sujets et de cadrage panoramique, avec un niveau de réflexion configurable qui échange la latence contre la qualité et un ancrage capable de vérifier les faits avec Google Search et Image Search avant de dessiner. Un élément de calendrier compte plus que les spécifications : Google ferme l’API du modèle précédent le 29 octobre et désigne celui-ci comme son remplaçant, ce n’est donc pas une mise à niveau facultative pour quiconque utilise l’ancien ID. Il n’a que quelques jours, alors considérez tout ce qui suit comme un compte rendu de première semaine.
Évalué à partir de nos propres rendus et des informations publiées, révisé à mesure que les faits évoluent — c’est une fonctionnalité de cette page, pas une clause de non-responsabilité.
• Environ la moitié du prix.
La tarification développeur de Google place une image 1K autour de $0.034 contre environ $0.067 auparavant, et la 4K autour de $0.076 contre $0.151, avec des remises supplémentaires pour le travail par lots. Une génération rare où l’option la moins chère est aussi la meilleure.
• Édition basée sur un masque.
Définissez une zone et ne modifiez que ce qui s'y trouve. Google présente cela comme l'une des plus grandes avancées par rapport à la version précédente, et c'est la fonctionnalité qui rend l'édition conversationnelle prévisible plutôt que fondée sur l'espoir.
• Cadres larges et panoramiques.
Des formats d’image jusqu’à 8:1, que le modèle précédent gérait mal. Les bannières, en-têtes de site et scènes panoramiques n’exigent plus un flux de travail « recadrer et prier ».
• Quatorze références, la réflexion sur un cadran.
Jusqu’à 14 images de référence, avec des niveaux de réflexion minimal, moyen et élevé, afin de consacrer de la latence là où cela compte et de l’éviter là où ce n’est pas nécessaire.
• Pro reste plus beau en utilisation réelle.
Google positionne 2.1 comme le pendant efficace de Nano Banana Pro, et non comme son remplaçant — et les analyses côte à côte du lancement indiquent que les couleurs et les proportions de Pro paraissent toujours plus naturelles. Les benchmarks et les yeux ne sont pas d’accord ici ; fiez-vous à vos yeux.
• Les chiffres de référence sont ceux de Google elle-même.
Les scores de préférence indiqués — 1,050 avec le mode réflexion contre 990 pour Nano Banana 2 et 935 pour Pro — proviennent des propres évaluations de Google. Les tests indépendants ne sont pas encore disponibles, et nous réviserons cette page lorsqu’ils le seront.
• Jours d’ancienneté.
Publié le 6 octobre. Tout ici remonte à la fiche de modèle de Google, à la couverture du lancement et à nos premiers rendus. Considérez les superlatifs comme provisoires.
• SynthID est toujours activé.
Comme pour toute la gamme Google, chaque sortie porte un filigrane de provenance invisible.
Copiez dans le générateur ci-dessus, remplacez les crochets, lancez le rendu.

"Une scène panoramique 8:1 [cuisine] à l'heure dorée: des casseroles en cuivre sur une barre, de la vapeur s'élevant d'une marmite, des herbes sur le rebord de la fenêtre, une lumière chaude rasant le plan de travail."
Les rapports d’aspect extrêmes sont l’amélioration visible la plus nette — demandez la forme dont vous avez réellement besoin plutôt que de générer en 16:9 puis de recadrer. La démo à côté du générateur correspond à ce prompt.

Générez ou importez, puis masquez la fenêtre → "Changez la vue extérieure en hiver — arbres dénudés, lumière grise. Gardez tout à l'intérieur de la pièce identique : les poêles, la vapeur, les herbes, la lumière sur le plan de travail."
Un masque porte le où, de sorte que le prompt ne porte que le quoi, et nommer ce qui reste protège le reste. C’est le flux de travail autour duquel la mise à jour 2.1 a été conçue.

Brouillon avec réflexion : minimale → refaire le rendu de la version à conserver avec réflexion : élevée.
Le cadran de réflexion sert à contrôler les coûts, ce n’est pas un interrupteur de qualité à laisser au maximum. Explorez à moindre coût et rapidement, puis consacrez la latence une seule fois au rendu que vous garderez.
Le nouveau modèle par défaut face au haut de gamme de Google et au modèle actuel d’OpenAI. Mêmes prompts pour les trois, jugés selon ce que nous publierions — provisoirement pour le nouveau venu. Tous trois sélectionnables dans le générateur ci-dessus.
(gemini-nano-banana-2.1) — basé sur Gemini 3.6 Flash : édition basée sur les masques, cohérence du sujet, panoramas 8:1, 4K, réflexion configurable, Search grounding, à environ la moitié du prix précédent. La version dans le générateur ci-dessus.
(Gemini 3.1 Flash Image) — le modèle par défaut de Google depuis février, avec son API dont l’arrêt est prévu le 29 octobre 2026 et 2.1 désigné comme remplaçant. Sa page reste en ligne pour le trafic lié aux mots-clés de version.
(Gemini 3 Pro Image) — reste le niveau supérieur pour les travaux professionnels les plus difficiles, et le modèle 2.1 est positionné comme un pendant efficace plutôt que comme un remplaçant.
Le tout dernier modèle de génération et d’édition d’images de Google, publié le 6 octobre 2026 sous l’ID API gemini-nano-banana-2.1 et basé sur Gemini 3.6 Flash. Google signale des améliorations en matière de conception visuelle, d’édition basée sur les masques, de cohérence des sujets et de cadrage grand format, avec jusqu’à 14 images de référence, une sortie 4K, des rapports d’aspect jusqu’à 8:1, un ancrage dans Search et trois niveaux de réflexion.