Flagowy model obrazów OpenAI: myśli, zanim zacznie rysować — planuje układ i sprawdza treść — oraz renderuje tekst, który można wysłać do druku. Wpisz poniżej prompt i wypróbuj go.
Programista
OpenAI
Wysyłane jako
Obrazy ChatGPT 2.0 / gpt-image-2
Podpis
Natywny tryb myślenia
Tekst na obrazie
Gotowe do druku · wielojęzyczne
Partie
8 obrazów, spójne
Maks. wyjście
2K
Poziom tutaj
Płatne kredyty
Nasz werdykt w jednym zdaniu: wybór do układów. Gdy obraz jest tak naprawdę dokumentem — menu, plakatem, makietą UI, czymkolwiek, gdzie słowa i struktura muszą przetrwać szczegółową analizę — ten model planuje go, zanim go narysuje.
GPT Image 2 pojawił się w kwietniu i w ciągu dwunastu godzin zajął miejsce #1 w każdej kategorii Image Arena — przewagą 242 punktów, największą, jaką kiedykolwiek odnotowano w rankingu. Powód architektoniczny jest najciekawszy: to pierwszy model obrazów OpenAI z natywnym rozumowaniem, planujący układ i sprawdzający treść przed renderowaniem, dlatego jego popisowy numer to coś historycznie niemożliwego — menu restauracji, w którym nazwa każdego dania jest zapisana poprawnie, a każda cena jest wyrównana. Jedna aktualna uwaga: OpenAI wycofuje stary DALL·E 30 sierpnia, a to jest model, który go zastąpił.
Oceniane na podstawie naszych własnych renderów i opublikowanych danych, aktualizowane wraz ze zmianą faktów — to cecha tej strony, a nie zastrzeżenie.
• Myślenie przed rysowaniem.
Natywne rozumowanie planuje kompozycję i weryfikuje treść przed renderowaniem — złożone układy, sceny wieloelementowe i stosy instrukcji znacznie częściej udają się za pierwszym razem.
• Tekst gotowy do druku.
Menu, plakaty, opakowania, makiety UI — wielojęzyczne, poprawnie napisane, odpowiednio sformatowane. Tryb awarii, który przez lata definiował obrazy AI, potraktowany jako rozwiązany obszar.
• Spójne partie po 8 obrazów.
Jedno żądanie, osiem wariantów zachowujących charakter i styl — iteracja oraz przepływ pracy A/B wbudowane w model, a nie doczepione później.
• Pas obrazu dokumentu.
Wszystko, co w gruncie rzeczy jest dokumentem — certyfikaty, etykiety, slajdy, makiety reklam — to obszar, w którym warstwa rozumowania wyraźnie przewyższa rywali opartych na dopasowywaniu wzorców.
• Myślenie wymaga czasu.
Rozumowanie dodaje realne opóźnienie w porównaniu z rywalami klasy flash. Do szybkiego generowania pomysłów przygotuj szkic gdzie indziej i przenieś tutaj finalny układ.
• Limit 2K.
Przepływy pracy 4K i druku powyżej 2K w Nano Banana wymagają upscalingu lub innego modelu. Dla większości ekranów bez znaczenia; dla dużego formatu decydujące.
• Kwietniowa korona na sierpniowym targu.
Przewaga +242 została zmierzona, zanim pojawiły się Seedream 5.0 Pro i letnia fala. Wciąż elita — ale traktuj 'największą przewagę w historii' jako historię, a nie aktualną tabelę.
• Brak oparcia w internecie.
Rozumuje na podstawie wiedzy, a nie wyszukiwania na żywo — materiał wizualny dotyczący bieżącego produktu lub wiadomości z dzisiejszego poranka może okazać się przestarzały. Ugruntowanie Nano Banana 2 obejmuje ten obszar.
Skopiuj do generatora powyżej, zamień nawiasy, wyrenderuj.

"Gotowe do druku menu bistro, A4 w orientacji pionowej: '[LUNE — Kuchnia sąsiedzka]' jako nagłówek, pięć dań głównych z cenami ($14–$22, wyrównane do prawej), trzy desery, krótka karta win, francuskie tłumaczenie pod nazwą każdego dania. Ciepły kremowy papier, klasyczny skład szeryfowy, bez błędów ortograficznych."
Gęsty, ustrukturyzowany tekst z regułami formatowania jest dokładnie tym, do czego służy tryb myślenia — model szkicuje układ przed wyrenderowaniem piksela. Demo obok generatora to ten prompt.

Partia ×8 → "[Product] ujęcie hero, oświetlenie studyjne: osiem wariantów eksplorujących kąt i kolor tła — ta sama skala produktu, ta sama orientacja etykiety, ta sama miękkość cienia we wszystkich ośmiu."
Nazwanie tego, co musi pozostać identyczne, sprawia, że partia staje się kontrolowanym eksperymentem zamiast ośmiu loterii. Wybierz zwycięzcę, a następnie wyrenderuj go ponownie osobno w pełnym rozmiarze.

"Przejrzysty ekran aplikacji mobilnej dla [trackera nawyków]: nagłówek 'Dzisiaj', cztery karty nawyków, każda z ikoną, nazwą i liczbą dni serii, dolny pasek kart z pięcioma opisanymi ikonami — wszystkie etykiety czytelne i poprawnie napisane, odstępy w stylu iOS, tryb jasny."
Interfejsy to w przebraniu dokumenty gęsto wypełnione tekstem. Wyliczenie elementów angażuje planer; 'czytelne i poprawnie napisane' wyznacza poprzeczkę, którą renderer tekstu faktycznie osiągnie.
Trzy flagowce, trzy teorie: najpierw rozumowanie, najpierw szybkość, najpierw edytowalność. Te same prompty we wszystkich trzech, oceniane według tego, co byśmy wdrożyli. Wszystkie trzy można wybrać w generatorze powyżej.
ChatGPT Images 2.0, wprowadzone 21 kwietnia: natywne myślenie, #1 we wszystkich kategoriach areny o +242 w ciągu dwunastu godzin, API jako gpt-image-2. Wersja w generatorze powyżej.
pokolenie wydajności: szybsze, tańsze edycje, które zachowywały szczegóły; najlepszy publiczny model obrazów OpenAI aż do kwietnia.
rodzina modeli, która zapoczątkowała erę obrazów AI w głównym nurcie, opuszcza ChatGPT; GPT Image 2 jest jej wyznaczonym następcą. Jeśli trafiłeś tu, szukając DALL·E, to właśnie tutaj prowadzi ta droga.
Flagowy model obrazów OpenAI, wprowadzony 21 kwietnia 2026 r. jako ChatGPT Images 2.0 (nazwa API gpt-image-2). To pierwszy model obrazów OpenAI z natywnym rozumowaniem — planuje układ i sprawdza treść przed renderowaniem — z wielojęzycznym tekstem gotowym do druku, spójnymi zestawami 8 obrazów i elastycznymi rozmiarami do 2K. Zadebiutował na 1. miejscu w każdej kategorii Image Arena, z największą przewagą, jaką kiedykolwiek odnotowano.