Googles neuestes Alltags-Bildmodell, in der Woche seiner Veröffentlichung integriert: bessere maskenbasierte Bearbeitung und Motivkonsistenz, 4K-Ausgabe und etwa halb so teuer wie das Modell, das es ersetzt.
Entwickler
Google DeepMind
Veröffentlicht
6. Okt. 2026
Basis
Gemini 3.6 Flash
API-ID
gemini-nano-banana-2.1
Ausgabe
Bis zu 4K · Seitenverhältnisse bis 8:1
Referenzen
Bis zu 14 Bilder
Denkt nach
Minimal · mittel · hoch
Unser Ein-Satz-Urteil: der neue Standard. Bessere Bearbeitung, breitere Frames und 4K für etwa die Hälfte dessen, was das letzte gekostet hat — und das Modell, das Google selbst als Ersatz für Nano Banana 2 empfiehlt.
Nano Banana 2.1 ist am 6. Oktober als direktes Upgrade des Modells erschienen, das seit Februar Googles Standard war, und die Schlagzeile ist ungewöhnlich: Es ist besser und kostet etwa halb so viel. Google meldet Verbesserungen bei visuellem Design, maskenbasierter Bearbeitung, Motivkonsistenz und Panorama-Bildkomposition, mit einem konfigurierbaren Denklevel, das Latenz gegen Qualität abwägt, und Grounding, das vor dem Zeichnen einen Faktencheck anhand von Google Search und Image Search durchführen kann. Ein Timing-Detail, das wichtiger ist als die technischen Daten: Google schaltet die API des vorherigen Modells am 29. Oktober ab und nennt dieses Modell als Ersatz, daher ist dies für alle, die die alte ID verwenden, kein optionales Upgrade. Es ist erst wenige Tage alt, lesen Sie daher alles Folgende als Berichterstattung aus der ersten Woche.
Beurteilt anhand unserer eigenen Renderings und der veröffentlichten Aufzeichnungen, überarbeitet, wenn sich die Fakten ändern — das ist ein Merkmal dieser Seite, kein Haftungsausschluss.
• Etwa zum halben Preis.
Googles Entwicklerpreise setzen ein 1K-Bild bei etwa $0.034 an, gegenüber etwa $0.067 zuvor, und 4K bei etwa $0.076 gegenüber $0.151, wobei Batch-Arbeiten zusätzlich rabattiert werden. Eine seltene Generation, bei der die günstigere Option auch die bessere ist.
• Maskenbasierte Bearbeitung.
Definieren Sie einen Bereich und ändern Sie nur das, was sich darin befindet. Google hebt dies als einen der größten Sprünge gegenüber der vorherigen Version hervor, und es ist die Funktion, die konversationelle Bearbeitung vorhersehbar statt hoffnungsbasiert macht.
• Breite und panoramische Bildausschnitte.
Seitenverhältnisse von bis zu 8:1, mit denen das vorherige Modell schlecht zurechtkam. Banner, Website-Header und Panoramaszenen erfordern keinen „Zuschneiden-und-Hoffen“-Workflow mehr.
• Vierzehn Referenzen, Denken auf einer Skala.
Bis zu 14 Referenzbilder, mit minimalen, mittleren und hohen Denkstufen, damit du Latenz dort einsetzen kannst, wo sie zählt, und sie dort überspringst, wo sie nicht nötig ist.
• Pro sieht in der Praxis immer noch besser aus.
Google positioniert 2.1 als effizientes Gegenstück zu Nano Banana Pro, nicht als dessen Ersatz — und Side-by-Side-Berichte zum Launch stellen fest, dass Farbe und Proportionen von Pro weiterhin natürlicher wirken. Benchmarks und Augen sind sich hier uneinig; vertrauen Sie Ihren Augen.
• Die Benchmark-Zahlen stammen von Google selbst.
Die gemeldeten Präferenzwerte — 1,050 mit Denkmodus gegenüber 990 für Nano Banana 2 und 935 für Pro — stammen aus Googles eigenen Bewertungen. Unabhängige Tests liegen noch nicht vor, und wir werden diese Seite überarbeiten, sobald sie verfügbar sind.
• Tage alt.
Veröffentlicht am 6. Oktober. Alles hier lässt sich auf Googles Model Card, die Berichterstattung zum Launch und unsere ersten Renderings zurückführen. Betrachten Sie Superlative als vorläufig.
• SynthID ist immer aktiviert.
Wie bei der gesamten Google-Reihe trägt jede Ausgabe ein unsichtbares Herkunfts-Wasserzeichen.
In den Generator oben kopieren, die Klammern austauschen, rendern.

"Eine 8:1-Panoramaszene [Küche] zur goldenen Stunde: Kupferpfannen an einer Schiene, Dampf steigt aus einem Topf auf, Kräuter auf der Fensterbank, warmes Licht streift über die Arbeitsplatte."
Extreme Seitenverhältnisse sind das am deutlichsten sichtbare Upgrade — fordere die Form an, die du tatsächlich brauchst, statt 16:9 zu generieren und zuzuschneiden. Die Demo neben dem Generator ist dieser Prompt.

Generieren oder hochladen, dann das Fenster maskieren → "Ändere die Aussicht draußen zu Winter — kahle Bäume, graues Licht. Lass alles im Raum identisch: die Pfannen, den Dampf, die Kräuter, das Licht auf der Arbeitsplatte."
Eine Maske trägt das Wo, sodass der Prompt nur das Was trägt, und zu benennen, was bleibt, schützt den Rest. Das ist der Workflow, um den herum das 2.1-Update entwickelt wurde.

Entwurf bei Denken: minimal → den Keeper bei Denken: hoch neu rendern.
Der Denkregler dient der Kostenkontrolle und ist kein Qualitätsschalter, den man auf Maximum stehen lässt. Erkunden Sie günstig und schnell, und investieren Sie die Latenz dann einmalig in das Rendering, das Sie behalten.
Der neue Standard im Vergleich zu Googles eigener Spitzenklasse und dem aktuellen Modell von OpenAI. Dieselben Prompts bei allen dreien, bewertet danach, was wir veröffentlichen würden — vorläufig für den Newcomer. Alle drei sind im Generator oben auswählbar.
(gemini-nano-banana-2.1) — basierend auf Gemini 3.6 Flash: maskenbasierte Bearbeitung, Motivkonsistenz, 8:1-Panoramen, 4K, konfigurierbares Denken, Search grounding, zu ungefähr der Hälfte des bisherigen Preises. Die Version im obigen Generator.
(Gemini 3.1 Flash Image) — Googles Standardmodell seit Februar, dessen API am 29. Oktober 2026 abgeschaltet werden soll und 2.1 als Ersatz benannt wurde. Die Seite bleibt für den Traffic über Versions-Keywords online.
(Gemini 3 Pro Image) — weiterhin die Spitzenklasse für die schwierigsten professionellen Arbeiten, und das Modell 2.1 ist als effizientes Gegenstück positioniert, nicht als Ersatz.
Googles neuestes Modell zur Bildgenerierung und -bearbeitung, veröffentlicht am 6. Oktober 2026 unter der API-ID gemini-nano-banana-2.1 und basierend auf Gemini 3.6 Flash. Google berichtet von Verbesserungen bei visuellem Design, maskenbasierter Bearbeitung, Motivkonsistenz und Breitformat-Bildgestaltung, mit bis zu 14 Referenzbildern, 4K-Ausgabe, Seitenverhältnissen bis 8:1, Search-Grounding und drei Denkstufen.