Googles Standard-Bildmodell: Pro-Level-Treue mit Flash-Geschwindigkeit, von 512px bis 4K, und Charaktere, die über einen gesamten Workflow hinweg sie selbst bleiben. Gib unten einen Prompt ein und probiere es aus.
Entwickler
Google DeepMind
Basis
Gemini 3.1 Flash Image
Auflösung
512px – 4K
Seitenverhältnisse
14
Konsistenz
5 Zeichen · 14 Objekte
Verankerung
Web-Bildersuche
Stufe hier
Bezahlte Guthaben · Lite kostenlos
Unser Fazit in einem Satz: aus gutem Grund die Standardeinstellung. Ergebnisse auf Pro-Niveau mit Flash-Geschwindigkeit und -Preis — starte jeden Bildauftrag hier und eskaliere nur, wenn dir eine bestimmte Seite sagt, warum.
Nano Banana 2 ist das Ergebnis davon, dass Google Sie nicht länger zwischen seinem schnellen Bildmodell und seinem guten wählen lässt: Basierend auf Gemini 3.1 Flash bietet es einen Großteil der Wiedergabetreue von Nano Banana Pro bei Flash-Geschwindigkeit und -Preis, weshalb Google es innerhalb eines Tages nach dem Launch im Februar zum Standard in der Gemini-App, in der Suche und in Ads gemacht hat. Die zwei Funktionen, die in der Praxis am wichtigsten sind: Charakterkonsistenz, die über einen Workflow hinweg bei bis zu fünf Charakteren und vierzehn Objekten erhalten bleibt — Storyboards und Brand-Sets driften nicht mehr auseinander — und Bildersuche-Grounding, wodurch es echte visuelle Referenzen aus dem Web abrufen kann, bevor es zeichnet.
Beurteilt anhand unserer eigenen Renderings und der veröffentlichten Aufzeichnungen, überarbeitet, wenn sich die Fakten ändern — das ist eine Funktion dieser Seite, kein Haftungsausschluss.
• Der Kompromiss zwischen Geschwindigkeit und Qualität, aufgelöst.
Pro-Level-Treue bei Flash-Latenz und -Preis. Der Grund, warum es überall Googles Standard ist, ist derselbe Grund, warum es bei fast jeder Bildaufgabe Ihr erster Versuch sein sollte.
• Konsistenz auf Workflow-Niveau.
Bis zu 5 Charaktere und 14 Objekte, über Generierungen hinweg stabil gehalten — die Storyboard-, Markenset- und Produktserienarbeit, für die früher ein Spezialist mit umfangreichem Referenzmaterial nötig war
• Grounding durch Bildsuche.
Es kann vor dem Zeichnen echte Webbilder konsultieren — ein bestimmtes Wahrzeichen, ein aktuelles Produkt, ein echtes Material — und so die Lücke zwischen 'plausibel' und 'genau' schließen.
• Vollständiges Produktionssortiment.
Von 512px-Thumbnails bis zu 4K-Hero-Bildern in 14 Seitenverhältnissen, mit einem einzigen Prompt-Vokabular. Ein Modell deckt das gesamte Asset-Sheet ab.
• Maximale Faktentreue ist die Aufgabe von Pro.
Googles eigene Aufteilung: dicht gepackte Infografiken, exakte Diagramme und textlastige Layouts, bei denen jede Tatsache ankommen muss, gehen an Nano Banana Pro. Dieses Modell ist der Generalist, nicht der Spezialist.
• Fünf Zeichen sind eine Obergrenze, kein Vorschlag.
Ensembleszenen mit mehr als fünf namentlich genannten Figuren beginnen, Identitäten zu tauschen. Plane Massenszenen als Hintergrundtextur, nicht als zehn Protagonisten.
• SynthID ist immer aktiviert.
Jede Ausgabe enthält Googles unsichtbares Wasserzeichen. Für fast alle in Ordnung; relevant, wenn Ihre Pipeline Herkunftsmarkierungen verbietet.
• Verankerung braucht Steuerung.
Web-Bild-Grounding ist leistungsstark, aber wörtlich — nicht geerdete Prompts zu berühmten Orten können generisch zurückkommen, übermäßig geerdete wirken wie Stockmaterial. Benenne, was echt sein soll; gib frei, was vorgestellt werden soll.
In den Generator oben kopieren, die Klammern austauschen, rendern.

"Ein sechsteiliges Storyboard, dieselbe illustrierte Figur in jedem Panel: ein [Kurier mit rotem Schal] — an einer Café-Theke, auf einem Bahnsteig, auf einem Dach in der Abenddämmerung, in einer Menschenmenge auf einem Markt, an einem Büroschreibtisch, an einem Strand bei Sonnenaufgang. Durchgehend einheitliches Gesicht, Körperbau und Schal; warmer Editorial-Illustrationsstil."
Sechs Szenen in einem Prompt sind das Heimspiel des Konsistenzsystems — die Benennung der Ankermerkmale („Gesicht, Körperbau und Schal“) sagt ihm, was nicht abweichen darf. Die Demo neben dem Generator ist dieser Prompt.

"Ein Produktfoto von [unserem Keramikbecher] auf einem Cafétisch, mit der echten Ponte Vecchio sichtbar durch das Fenster dahinter, Morgenlicht, geringe Schärfentiefe — die Brücke sollte wie die tatsächliche Brücke aussehen."
'Die tatsächliche Brücke' ist die Formulierung, die die Verankerung per Bildsuche aktiviert: Sie zieht echte Bilder heran, statt ein generisches Wahrzeichen zu improvisieren. Verankere die Umgebung, behalte das Produkt aus deinem Referenz-Upload bei.

"[Markenmaskottchen] winkend, flacher Vektorstil auf transparent wirkendem Weiß: in 1:1 für Avatar, 16:9 für Banner, 9:16 für Story, 21:9 für Website-Header generieren — gleiche Pose, gleiche Proportionen in allen vier."
Ein Prompt, vier Seitenverhältnisse, null Drift — die Alltagsaufgabe, die dieses Modell günstiger und schneller erledigt als alles darüber. Verarbeite die Seitenverhältnisse im Batch, statt für jede Größe erneut zu prompten.
Der Standard gegen sein eigenes spezialisiertes Geschwistermodell und den Arena-Champion vom April. Dieselben Prompts für alle drei, bewertet nach dem, was wir ausliefern würden. Alle drei sind im Generator oben auswählbar.
(Gemini 3.1 Flash Image) — am 26. Februar eingeführt, innerhalb eines Tages standardmäßig in Gemini, Search, Ads und Flow; GA für Unternehmen im Mai; Eingabe von Videodateien in der Vorschau hinzugefügt. Die Version im Generator oben.
(Gemini 3 Pro Image) — die High-Fidelity-Stufe: durch Schlussfolgern gestützte Genauigkeit, Studio-Steuerelemente, 4K. Weiterhin aktuell für faktenbasierte Arbeit; die eigene Seite erklärt, wann sich der Aufpreis lohnt.
(Gemini 2.5 Flash Image) — das virale Original: 13 Millionen neue Nutzer in vier Tagen, fünf Milliarden Bilder bis Oktober. Jetzt Legacy; Google empfiehlt stattdessen die Modelle der 2. Generation.
Googles aktuelles Mainline-Bildmodell — technisch Gemini 3.1 Flash Image, veröffentlicht am 26. Februar 2026. Es verbindet die Wiedergabetreue von Nano Banana Pro mit Geschwindigkeit und Preis der Flash-Klasse: Ausgabe von 512px bis 4K, 14 Seitenverhältnisse, Konsistenz für bis zu 5 Charaktere und 14 Objekte pro Workflow sowie Bildersuche-Grounding, das vor dem Zeichnen reale Webbilder heranzieht. Es ist das standardmäßige Bildmodell in Googles eigenen Produkten.