Domyślny model obrazów Google: profesjonalna wierność z szybkością Flash, od 512px do 4K, oraz postacie, które pozostają sobą przez cały workflow. Wpisz prompt poniżej i wypróbuj go.
Deweloper
Google DeepMind
Podstawowy
Gemini 3.1 Flash Image
Rozdzielczość
512px – 4K
Proporcje obrazu
14
Spójność
5 znaków · 14 obiektów
Ugruntowanie
Wyszukiwanie obrazów w sieci
Poziom tutaj
Płatne kredyty · Lite za darmo
Nasz werdykt w jednym zdaniu: domyślne ustawienie nie bez powodu. Wyniki na poziomie Pro z szybkością i ceną Flash — zaczynaj tutaj każde zadanie związane z obrazem i przechodź wyżej tylko wtedy, gdy konkretna strona wyjaśni dlaczego.
Nano Banana 2 jest tym, co powstało, gdy Google przestało zmuszać użytkowników do wyboru między swoim szybkim modelem do obrazów a tym dobrym: zbudowany na Gemini 3.1 Flash, zachowuje większość wierności odwzorowania Nano Banana Pro przy szybkości i cenie Flash, dlatego Google uczynił go domyślnym w aplikacji Gemini, wyszukiwarce i Ads w ciągu jednego dnia od lutowej premiery. Dwie możliwości, które w praktyce liczą się najbardziej: spójność postaci utrzymująca do pięciu postaci i czternastu obiektów w całym przepływie pracy — storyboardy i zestawy marki przestają się rozjeżdżać — oraz oparcie na wyszukiwaniu obrazów, dzięki któremu może pobierać prawdziwe odniesienia wizualne z sieci, zanim zacznie rysować.
Oceniane na podstawie naszych własnych renderów i opublikowanych danych, aktualizowane wraz ze zmianą faktów — to cecha tej strony, a nie zastrzeżenie.
• Kompromis między szybkością a jakością, rozwiązany.
Wierność na poziomie Pro przy opóźnieniach i cenie Flash. Powód, dla którego jest to domyślny wybór Google wszędzie, jest tym samym powodem, dla którego powinien to być Twój pierwszy wybór przy niemal każdym zadaniu związanym z obrazem.
• Spójność na poziomie przepływu pracy.
Do 5 postaci i 14 obiektów utrzymywanych stabilnie w kolejnych generacjach — praca nad storyboardami, zestawami marki i seriami produktów, która kiedyś wymagała specjalisty korzystającego z licznych referencji
• Ugruntowanie przez wyszukiwanie obrazów.
Może sprawdzać rzeczywiste obrazy z sieci przed rysowaniem — konkretny punkt orientacyjny, aktualny produkt, prawdziwy materiał — zmniejszając lukę między 'prawdopodobne' a 'dokładne.'
• Pełny zakres produkcji.
Od miniatur 512px po obrazy hero 4K w 14 proporcjach obrazu, z użyciem jednego słownika promptów. Jeden model obejmuje cały arkusz zasobów.
• Maksymalna wierność faktom to zadanie Pro.
Własny podział Google: gęste infografiki, precyzyjne diagramy i układy z dużą ilością tekstu, w których każdy fakt musi zostać przekazany, trafiają do Nano Banana Pro. Ten model jest generalistą, nie specjalistą.
• Pięć znaków to limit, nie sugestia.
Sceny zespołowe z ponad pięcioma nazwanymi postaciami zaczynają zamieniać się tożsamościami. Planuj sceny zbiorowe jako tło, a nie jako dziesięciu protagonistów.
• SynthID jest zawsze włączony.
Każdy wynik zawiera niewidoczny znak wodny Google. W porządku dla niemal wszystkich; istotne, jeśli Twój proces zabrania oznaczeń pochodzenia.
• Ugruntowanie wymaga ukierunkowania.
Ugruntowanie na obrazach z sieci jest potężne, ale dosłowne — promptów o słynnych miejscach bez ugruntowania mogą wracać jako generyczne, a te z nadmiernym ugruntowaniem jako stockowe. Nazwij to, co powinno być prawdziwe; uwolnij to, co powinno być wyobrażone.
Skopiuj do generatora powyżej, zamień nawiasy, wyrenderuj.

"Sześciopanelowy storyboard, ta sama ilustrowana postać w każdym panelu: [kurier z czerwonym szalikiem] — przy ladzie w kawiarni, na peronie kolejowym, na dachu o zmierzchu, w tłumie na targu, przy biurku w biurze, na plaży o świcie. Spójna twarz, sylwetka i szalik przez cały czas; ciepły styl ilustracji editorialowej."
Sześć scen w jednym prompcie to naturalne środowisko systemu spójności — nazwanie cech kotwiczących („twarz, sylwetka i szalik”) mówi mu, co nie może się zmieniać. Demo obok generatora to właśnie ten prompt.

"Zdjęcie produktowe [naszego ceramicznego kubka] na stoliku w kawiarni, z prawdziwym Ponte Vecchio widocznym przez okno za nim, poranne światło, mała głębia ostrości — most powinien wyglądać jak rzeczywisty most."
'Rzeczywisty most' to fraza, która uruchamia osadzanie oparte na wyszukiwaniu obrazów: korzysta z rzeczywistych obrazów zamiast improwizować ogólny punkt orientacyjny. Osadź scenerię w rzeczywistości, zachowaj produkt z przesłanego pliku referencyjnego.

"[Maskotka marki] machająca, płaski styl wektorowy na bieli wyglądającej jak przezroczysta: wygeneruj w 1:1 dla awatara, 16:9 dla banera, 9:16 dla relacji, 21:9 dla nagłówka strony — ta sama poza, te same proporcje we wszystkich czterech."
Jeden prompt, cztery proporcje, zero dryfu — codzienne zadanie, które ten model wykonuje taniej i szybciej niż cokolwiek powyżej niego. Przetwarzaj proporcje wsadowo, zamiast ponownie wpisywać prompt dla każdego rozmiaru.
Domyślny wariant kontra jego wyspecjalizowany siostrzany model i kwietniowy mistrz areny. Te same prompty we wszystkich trzech, oceniane według tego, co byśmy wydali. Wszystkie trzy są dostępne do wyboru w generatorze powyżej.
(Gemini 3.1 Flash Image) — uruchomiony 26 lutego, w ciągu jednego dnia stał się domyślny w Gemini, Search, Ads i Flow; GA dla przedsiębiorstw w maju; w wersji zapoznawczej dodano wejście plików wideo. Wersja w generatorze powyżej.
(Gemini 3 Pro Image) — poziom wysokiej wierności: dokładność wsparta rozumowaniem, sterowanie studyjne, 4K. Nadal aktualny do pracy faktograficznej; jego własna strona wyjaśnia, kiedy zasługuje na dopłatę premium.
(Gemini 2.5 Flash Image) — wiralowy oryginał: 13 milionów nowych użytkowników w cztery dni, pięć miliardów obrazów do października. Obecnie model legacy; Google zaleca w jego miejsce modele 2. generacji.
Obecny główny model obrazów Google — technicznie Gemini 3.1 Flash Image, wprowadzony 26 lutego 2026 r. Łączy wierność Nano Banana Pro z szybkością i ceną klasy Flash: wynik od 512px do 4K, 14 proporcji obrazu, spójność dla maksymalnie 5 postaci i 14 obiektów w jednym przepływie pracy oraz ugruntowanie wyszukiwania obrazem, które przed rysowaniem korzysta z prawdziwych obrazów z sieci. To domyślny model obrazów we własnych produktach Google.