Googles standardbildmodell: trohet på proffsnivå i Flash-hastighet, från 512px till 4K, och karaktärer som förblir sig själva genom ett helt arbetsflöde. Skriv en prompt nedan och prova.
Utvecklare
Google DeepMind
Bas
Gemini 3.1 Flash Image
Upplösning
512px – 4K
Bildförhållanden
14
Konsekvens
5 tecken · 14 objekt
Jordning
Bildsökning på webben
Nivå här
Betalda krediter · Lite gratis
Vårt omdöme på en rad: standard av en anledning. Resultat på Pro-nivå med Flash-hastighet och -pris — starta varje bildjobb här och eskalera bara när en specifik sida berättar varför.
Nano Banana 2 är vad som hände när Google slutade tvinga dig att välja mellan sin snabba bildmodell och sin bra: byggd på Gemini 3.1 Flash, den behåller det mesta av Nano Banana Pros detaljtrohet med Flash-hastighet och pris, vilket är anledningen till att Google gjorde den till standard i Gemini-appen, Sök och Ads inom ett dygn efter lanseringen i februari. De två funktioner som betyder mest i praktiken: karaktärskonsekvens som håller för upp till fem karaktärer och fjorton objekt genom ett arbetsflöde — storyboards och varumärkesuppsättningar slutar glida isär — och grundning i bildsökning, vilket låter den hämta verkliga visuella referenser från webben innan den ritar.
Bedömt utifrån våra egna renderingar och det publicerade underlaget, reviderat när fakta förändras — det är en funktion på den här sidan, inte en friskrivning.
• Kompromissen mellan hastighet och kvalitet, upplöst.
Pro-nivåns återgivning med Flash-latens och -pris. Anledningen till att det är Googles standard överallt är samma anledning till att det bör vara ditt första försök för nästan alla bilduppgifter.
• Konsekvens på arbetsflödesnivå.
Upp till 5 karaktärer och 14 objekt som hålls stabila över generationer — storyboard-, varumärkesset- och produktseriearbete som tidigare krävde en specialist med många referenser
• Grundning genom bildsökning.
Den kan konsultera verkliga webbilder innan den ritar — ett specifikt landmärke, en aktuell produkt, ett verkligt material — och överbrygga gapet mellan 'rimligt' och 'korrekt.'
• Fullständigt produktionssortiment.
Från 512px-miniatyrer till 4K-hero-bilder i 14 bildförhållanden, med ett enda prompt-ordförråd. En modell täcker hela asset-arket.
• Maximal faktamässig trohet är Pros jobb.
Googles egen uppdelning: täta infografiker, exakta diagram och texttunga layouter där varje faktauppgift måste nå fram går till Nano Banana Pro. Den här modellen är generalisten, inte specialisten.
• Fem tecken är en gräns, inte ett förslag.
Ensemblescener med fler än fem namngivna karaktärer börjar byta identiteter. Planera folkscener som bakgrundstextur, inte som tio protagonister.
• SynthID är alltid på.
Varje utdata innehåller Googles osynliga vattenstämpel. Okej för nästan alla; relevant om din pipeline förbjuder ursprungsmärken.
• Förankring behöver styrning.
Webbilds-grounding är kraftfullt men bokstavligt — ogrundade prompts om berömda platser kan komma tillbaka generiska, övergrundade kan se ut som stockmaterial. Namnge det som ska vara verkligt; frigör det som ska föreställas.
Kopiera till generatorn ovan, byt ut hakparenteserna, rendera.

"En storyboard med sex paneler, samma illustrerade karaktär i varje panel: en [budbärare med en röd halsduk] — vid en cafédisk, på en tågperrong, på ett tak i skymningen, i en marknadsträngsel, vid ett kontorsskrivbord, på en strand i gryningen. Konsekvent ansikte, kroppsbyggnad och halsduk genomgående; varm redaktionell illustrationsstil."
Sex scener i en enda prompt är konsekvenssystemets hemmaplan — att namnge ankarfunktionerna (”ansikte, kroppsbyggnad och halsduk”) talar om för det vad som inte får glida. Demot bredvid generatorn är den här prompten.

"Ett produktfoto av [vår keramiska mugg] på ett kafébord, med den riktiga Ponte Vecchio synlig genom fönstret bakom den, morgonljus, kort skärpedjup — bron ska se ut som den faktiska bron."
'Den faktiska bron' är frasen som aktiverar förankring via bildsökning: den konsulterar verkliga bilder i stället för att improvisera ett generiskt landmärke. Förankra miljön, behåll produkten från din referensuppladdning.

"[Varumärkesmaskot] som vinkar, platt vektorstil på transparent-liknande vitt: generera i 1:1 för avatar, 16:9 för banner, 9:16 för story, 21:9 för webbplatshuvud — samma pose, samma proportioner i alla fyra."
En prompt, fyra bildförhållanden, noll drift — det vardagsjobb som den här modellen gör billigare och snabbare än allt ovanför den. Batchbehandla bildförhållandena i stället för att prompta om för varje storlek.
Standardmodellen mot sitt eget specialiserade syskon och aprils arenamästare. Samma prompter för alla tre, bedömda efter vad vi skulle lansera. Alla tre kan väljas i generatorn ovan.
(Gemini 3.1 Flash Image) — lanserad 26 februari, standard i Gemini, Search, Ads och Flow inom en dag; GA för företag i maj; inmatning av videofiler tillagd i förhandsversion. Versionen i generatorn ovan.
(Gemini 3 Pro Image) — nivån med hög återgivning: resonemangsbaserad noggrannhet, studiokontroller, 4K. Fortfarande aktuell för faktabaserat arbete; dess egen sida beskriver när den förtjänar premiumpriset.
(Gemini 2.5 Flash Image) — det virala originalet: 13 miljoner nya användare på fyra dagar, fem miljarder bilder till oktober. Nu äldre; Google rekommenderar 2:a generationens modeller i stället.
Googles nuvarande huvudmodell för bilder — tekniskt sett Gemini 3.1 Flash Image, lanserad den 26 februari 2026. Den förenar Nano Banana Pros detaljtrohet med hastighet och pris på Flash-nivå: 512px till 4K-utdata, 14 bildförhållanden, konsekvens för upp till 5 karaktärer och 14 objekt per arbetsflöde, samt bildsökningsbaserad förankring som konsulterar verkliga webbilder innan den ritar. Den är standardbildmodellen i Googles egna produkter.