Googles senaste bildmodell för vardagsbruk, integrerad samma vecka som den lanserades: bättre maskbaserad redigering och motivkonsekvens, 4K-utdata och ungefär halva priset jämfört med modellen den ersätter.
Utvecklare
Google DeepMind
Släppt
6 okt. 2026
Bas
Gemini 3.6 Flash
API-ID
gemini-nano-banana-2.1
Utdata
Upp till 4K · bildförhållanden upp till 8:1
Referenser
Upp till 14 bilder
Tänker
Minimal · medel · hög
Vårt omdöme i en rad: den nya standarden. Bättre redigering, bredare bildrutor och 4K till ungefär halva kostnaden jämfört med den förra — och modellen som Google själv rekommenderar som ersättare för Nano Banana 2.
Nano Banana 2.1 kom den 6 oktober som en direkt uppgradering av modellen som hade varit Googles standard sedan februari, och huvudbudskapet är ovanligt: den är bättre och kostar ungefär hälften så mycket. Google rapporterar förbättringar inom visuell design, maskbaserad redigering, motivkonsekvens och panoramisk inramning, med en konfigurerbar tänknivå som byter latens mot kvalitet och grounding som kan faktakontrollera mot Google Search och Image Search innan den ritar. En tidsaspekt som är viktigare än specifikationerna: Google stänger ner den tidigare modellens API den 29 oktober och anger denna som ersättaren, så detta är inte en valfri uppgradering för någon som kör det gamla ID:t. Den är bara några dagar gammal, så läs allt nedan som rapportering från första veckan.
Bedömt utifrån våra egna renderingar och den publicerade dokumentationen, reviderat i takt med att fakta ändras — det är en funktion på den här sidan, inte en ansvarsfriskrivning.
• Ungefär halva priset.
Googles utvecklarpriser sätter en 1K-bild på cirka $0.034 jämfört med omkring $0.067 tidigare, och 4K på cirka $0.076 jämfört med $0.151, med ytterligare rabatt för batcharbete. En sällsynt generation där det billigare alternativet också är det bättre.
• Maskbaserad redigering.
Definiera ett område och ändra bara det som finns inuti. Google lyfter fram detta som ett av de största sprången jämfört med den tidigare versionen, och det är funktionen som gör konversationsbaserad redigering förutsägbar i stället för att bygga på hopp.
• Breda och panoramiska bildrutor.
Bildförhållanden upp till 8:1, vilket den tidigare modellen hanterade dåligt. Banners, webbplatshuvuden och panoramascener kräver inte längre ett ”beskär och hoppas”-arbetsflöde.
• Fjorton referenser, tänkande på en ratt.
Upp till 14 referensbilder, med minimala, medelhöga och höga tänknivåer så att du kan lägga latens där det spelar roll och hoppa över den där den inte behövs.
• Pro ser fortfarande bättre ut i verklig användning.
Google positionerar 2.1 som den effektiva motsvarigheten till Nano Banana Pro, inte som dess ersättare — och jämförande rapportering från lanseringen noterar att Pros färger och proportioner fortfarande upplevs mer naturliga. Benchmarks och ögon är oense här; lita på dina ögon.
• Benchmark-siffrorna är Googles egna.
De rapporterade preferenspoängen — 1,050 med tänkande jämfört med 990 för Nano Banana 2 och 935 för Pro — kommer från Googles egna utvärderingar. Oberoende tester har inte kommit ännu, och vi kommer att revidera den här sidan när de gör det.
• Dagar gammal.
Lanserad 6 oktober. Allt här kan spåras till Googles modellkort, lanseringsbevakning och våra första renderingar. Betrakta superlativer som preliminära.
• SynthID är alltid aktiverat.
Precis som i hela Google-serien bär varje utdata en osynlig proveniensvattenstämpel.
Kopiera till generatorn ovan, byt ut hakparenteserna, rendera.

"En panoramisk 8:1-[kök]scen under den gyllene timmen: kopparpannor på en skena, ånga som stiger från en kastrull, örter på fönsterbrädan, varmt ljus som stryker över bänkskivan."
Extrema bildförhållanden är den tydligaste synliga uppgraderingen — be om den form du faktiskt behöver i stället för att generera 16:9 och beskära. Demon bredvid generatorn är denna prompt.

Generera eller ladda upp, maskera sedan fönstret → "Ändra vyn utanför till vinter — kala träd, grått ljus. Behåll allt inne i rummet identiskt: stekpannorna, ångan, örterna, ljuset på bänken."
En mask bär var, så prompten bär bara vad, och att namnge det som blir kvar skyddar resten. Det här är arbetsflödet som 2.1-uppdateringen byggdes kring.

Utkast med tänkande: minimalt → rendera om den behållna versionen med tänkande: högt.
Tänkreglaget är till för kostnadskontroll, inte en kvalitetsbrytare som ska lämnas på max. Utforska billigt och snabbt, och lägg sedan latensen en enda gång på renderingen du tänker behålla.
Den nya standarden mot Googles egen toppnivå och OpenAI:s nuvarande modell. Samma prompts för alla tre, bedömda efter vad vi skulle släppa — preliminärt för nykomlingen. Alla tre kan väljas i generatorn ovan.
(gemini-nano-banana-2.1) — byggd på Gemini 3.6 Flash: maskbaserad redigering, motivkonsekvens, 8:1-panoramor, 4K, konfigurerbart tänkande, Search grounding, till ungefär halva det tidigare priset. Versionen i generatorn ovan.
(Gemini 3.1 Flash Image) — Googles standardmodell sedan februari, med dess API planerat att stängas ned den 29 oktober 2026 och 2.1 utsedd som ersättare. Dess sida finns kvar för trafik från versionsnyckelord.
(Gemini 3 Pro Image) — fortfarande toppnivån för det svåraste professionella arbetet, och modellen 2.1 positioneras som den effektiva motsvarigheten snarare än som en ersättning.
Googles senaste modell för bildgenerering och bildredigering, lanserad den 6 oktober 2026 under API-ID:t gemini-nano-banana-2.1 och byggd på Gemini 3.6 Flash. Google rapporterar förbättringar inom visuell design, maskbaserad redigering, motivkonsekvens och bredformatsinramning, med upp till 14 referensbilder, 4K-utdata, bildförhållanden upp till 8:1, Search-grounding och tre tankenivåer.