Il più recente modello di immagini per l’uso quotidiano di Google, integrato nella settimana del lancio: editing basato su maschere e coerenza del soggetto migliori, output 4K e circa la metà del prezzo del modello che sostituisce.
Sviluppatore
Google DeepMind
Rilasciato
6 ott 2026
Base
Gemini 3.6 Flash
ID API
gemini-nano-banana-2.1
Risultato
Fino a 4K · rapporti fino a 8:1
Riferimenti
Fino a 14 immagini
Elaborazione
Minimo · medio · alto
Il nostro verdetto in una riga: il nuovo standard. Editing migliore, frame più ampi e 4K a circa la metà del costo del precedente — e il modello che Google stessa consiglia come sostituto di Nano Banana 2.
Nano Banana 2.1 è arrivato il 6 ottobre come aggiornamento diretto del modello che era stato il predefinito di Google da febbraio, e il punto principale è insolito: è migliore e costa circa la metà. Google segnala miglioramenti nel design visivo, nell'editing basato su maschere, nella coerenza del soggetto e nelle inquadrature panoramiche, con un livello di ragionamento configurabile che scambia latenza con qualità e una funzionalità di grounding che può effettuare fact-checking con Google Search e Image Search prima di generare l'immagine. Un aspetto delle tempistiche conta più delle specifiche: Google disattiverà l'API del modello precedente il 29 ottobre e indica questo come sostituto, quindi non si tratta di un aggiornamento opzionale per chiunque stia usando il vecchio ID. È uscito da pochi giorni, quindi leggi tutto ciò che segue come un resoconto della prima settimana.
Valutato in base ai nostri rendering e al materiale pubblicato, rivisto man mano che i fatti cambiano — questa è una caratteristica di questa pagina, non una clausola di esclusione di responsabilità.
• Circa la metà del prezzo.
I prezzi per sviluppatori di Google portano un'immagine 1K a circa $0.034 rispetto ai circa $0.067 di prima, e 4K a circa $0.076 rispetto a $0.151, con ulteriori sconti per il lavoro in batch. Una rara generazione in cui l'opzione più economica è anche quella migliore.
• Modifica basata su maschera.
Definisci un'area e modifica solo ciò che contiene. Google la indica come uno dei più grandi passi avanti rispetto alla versione precedente, ed è la funzione che rende l'editing conversazionale prevedibile anziché affidato alla speranza.
• Inquadrature ampie e panoramiche.
Rapporti d'aspetto fino a 8:1, che il modello precedente gestiva male. Banner, intestazioni dei siti e scene panoramiche non richiedono più un workflow “ritaglia e spera”.
• Quattordici riferimenti, pensiero su un quadrante.
Fino a 14 immagini di riferimento, con livelli di ragionamento minimo, medio e alto, così puoi dedicare latenza dove conta e evitarla dove non serve.
• Pro ha ancora un aspetto migliore nell'uso reale.
Google posiziona 2.1 come la controparte efficiente di Nano Banana Pro, non come il suo sostituto — e le analisi affiancate del lancio rilevano che i colori e le proporzioni di Pro risultano ancora più naturali. Benchmark e occhi qui non concordano; fidati dei tuoi occhi.
• I numeri del benchmark sono di Google stessa.
I punteggi di preferenza riportati — 1,050 con il ragionamento rispetto a 990 per Nano Banana 2 e 935 per Pro — provengono dalle valutazioni interne di Google. I test indipendenti non sono ancora arrivati e aggiorneremo questa pagina quando saranno disponibili.
• Giorni.
Rilasciato il 6 ottobre. Tutto qui deriva dalla model card di Google, dalla copertura del lancio e dai nostri primi rendering. Considera i superlativi come provvisori.
• SynthID è sempre attivo.
Come per l'intera linea Google, ogni output contiene un watermark di provenienza invisibile.
Copia nel generatore qui sopra, sostituisci le parentesi, renderizza.

"Una scena panoramica 8:1 [cucina] all'ora dorata: padelle di rame su una barra, vapore che sale da una pentola, erbe aromatiche sul davanzale, luce calda che lambisce il piano di lavoro."
I rapporti d'aspetto estremi sono l'upgrade visibile più evidente — chiedi la forma di cui hai davvero bisogno invece di generare in 16:9 e ritagliare. La demo accanto al generatore è questo prompt.

Genera o carica, poi maschera la finestra → "Cambia la vista all'esterno in inverno — alberi spogli, luce grigia. Mantieni tutto all'interno della stanza identico: le padelle, il vapore, le erbe, la luce sul bancone."
Una maschera porta il dove, quindi il prompt porta solo il cosa, e nominare ciò che resta protegge il resto. Questo è il flusso di lavoro attorno al quale è stato costruito l'aggiornamento 2.1.

Bozza con ragionamento: minimo → riesegui il rendering della versione da conservare con ragionamento: alto.
La manopola del ragionamento serve a controllare i costi, non è un interruttore di qualità da lasciare al massimo. Esplora in modo economico e veloce, poi dedica la latenza una sola volta al rendering che conserverai.
Il nuovo predefinito a confronto con la fascia più alta di Google e il modello attuale di OpenAI. Stessi prompt per tutti e tre, giudicati in base a ciò che pubblicheremmo — in via provvisoria per il nuovo arrivato. Tutti e tre selezionabili nel generatore qui sopra.
(gemini-nano-banana-2.1) — basato su Gemini 3.6 Flash: modifica basata su maschere, coerenza del soggetto, panorami 8:1, 4K, pensiero configurabile, Search grounding, a circa metà del prezzo precedente. La versione nel generatore sopra.
(Gemini 3.1 Flash Image) — il modello predefinito di Google da febbraio, con la sua API programmata per la chiusura il 29 ottobre 2026 e 2.1 indicato come sostituto. La sua pagina resta online per il traffico delle parole chiave della versione.
(Gemini 3 Pro Image) — rimane ancora il livello più alto per i lavori professionali più difficili, e il modello 2.1 è posizionato come controparte efficiente piuttosto che come sostituto.
Il più recente modello di generazione e modifica di immagini di Google, rilasciato il 6 ottobre 2026 con l'ID API gemini-nano-banana-2.1 e basato su Gemini 3.6 Flash. Google segnala miglioramenti nel design visivo, nella modifica basata su maschere, nella coerenza dei soggetti e nell'inquadratura in formato ampio, con fino a 14 immagini di riferimento, output 4K, rapporti d'aspetto fino a 8:1, grounding tramite Search e tre livelli di ragionamento.