Model imej utama OpenAI: ia berfikir sebelum melukis — merancang reka letak dan menyemak kandungan — serta memaparkan teks yang boleh anda hantar untuk dicetak. Taipkan gesaan di bawah dan cuba.
Pembangun
OpenAI
Dihantar sebagai
Imej ChatGPT 2.0 / gpt-image-2
Tandatangan
Mod pemikiran asli
Teks dalam imej
Sedia untuk dicetak · berbilang bahasa
Kelompok
8 imej, konsisten
Output maks
2K
Tahap di sini
Kredit berbayar
Keputusan kami dalam satu baris: pilihan untuk reka letak. Apabila imej sebenarnya ialah dokumen — menu, poster, mockup UI, apa sahaja yang memerlukan perkataan dan struktur kekal utuh di bawah penelitian — model ini merancangnya sebelum melukisnya.
GPT Image 2 dilancarkan pada bulan April dan meraih tempat #1 dalam setiap kategori Image Arena dalam masa dua belas jam — dengan kelebihan 242 mata, margin terbesar yang pernah direkodkan oleh papan pendahulu. Sebab seni binanya ialah bahagian yang menarik: ini ialah model imej pertama OpenAI dengan penaakulan natif, yang merancang susun atur dan menyemak kandungan sebelum merender, sebab itulah kehebatannya ialah sesuatu yang sebelum ini dianggap mustahil — menu restoran yang setiap hidangannya dieja dengan betul dan setiap harganya sejajar. Satu nota tepat pada masanya: OpenAI menamatkan DALL·E lama pada 30 Ogos, dan inilah model yang menggantikannya.
Dinilai berdasarkan render kami sendiri dan rekod yang diterbitkan, disemak apabila fakta berubah — itu ialah ciri halaman ini, bukan penafian.
• Berfikir sebelum melukis.
Penaakulan natif merancang komposisi dan mengesahkan kandungan sebelum pemaparan — susun atur kompleks, adegan berbilang elemen dan tindanan arahan jauh lebih kerap berjaya pada percubaan pertama.
• Teks sedia cetak.
Menu, poster, pembungkusan, mockup UI — berbilang bahasa, dieja dengan betul, diformat dengan betul. Mod kegagalan yang mentakrifkan imej AI selama bertahun-tahun, dianggap sebagai kawasan yang telah diselesaikan.
• Kelompok 8 imej yang konsisten.
Satu permintaan, lapan variasi yang mengekalkan watak dan gaya — aliran kerja iterasi dan A/B dibina ke dalam model, bukan ditampal kemudian.
• Lorong imej dokumen.
Apa-apa sahaja yang sebenarnya merupakan dokumen — sijil, label, slaid, iklan olok-olok — ialah tempat lapisan penaakulan jelas mengatasi pesaing yang berasaskan padanan corak.
• Berfikir memerlukan masa.
Penaakulan menambah kependaman sebenar berbanding pesaing kelas flash. Untuk penjanaan idea yang pantas, sediakan draf di tempat lain dan bawa reka letak akhir ke sini.
• Had 2K.
Aliran kerja 4K dan aliran kerja cetakan melebihi 2K Nano Banana memerlukan peningkatan skala atau model yang berbeza. Untuk kebanyakan skrin, tidak relevan; untuk format besar, penentu.
• Mahkota April di pasar Ogos.
Margin +242 diukur sebelum Seedream 5.0 Pro dan gelombang musim panas tiba. Masih elit — tetapi anggap 'pendahuluan terbesar sepanjang masa' sebagai sejarah, bukan kedudukan semasa.
• Tiada pembumian web.
Ia membuat penaakulan berdasarkan pengetahuan, bukan carian langsung — visual produk semasa atau berita pagi ini boleh kembali sebagai lapuk. Ciri grounding Nano Banana 2 merangkumi ruang itu.
Salin ke dalam penjana di atas, tukar kurungan, renderkan.

"Menu bistro sedia cetak, A4 potret: '[LUNE — Dapur Kejiranan]' sebagai pengepala, lima hidangan utama dengan harga ($14–$22, dijajarkan ke kanan), tiga pencuci mulut, senarai wain ringkas, terjemahan bahasa Perancis di bawah setiap nama hidangan. Kertas krim hangat, tatahuruf serif klasik, tiada kesalahan ejaan."
Teks berstruktur padat dengan peraturan pemformatan ialah tepat untuk kegunaan mod berfikir — model merangka reka letak sebelum memaparkan satu piksel. Demo di sebelah penjana ialah prompt ini.

Kelompok ×8 → "[Product] imej hero, pencahayaan studio: lapan variasi meneroka sudut dan warna latar belakang — skala produk yang sama, orientasi label yang sama, kelembutan bayang yang sama dalam kesemua lapan."
Menamakan perkara yang mesti kekal sama menjadikan satu kelompok sebagai eksperimen terkawal, bukannya lapan loteri. Pilih pemenang, kemudian render semula ia sahaja pada saiz penuh.

"Skrin aplikasi mudah alih yang bersih untuk [penjejak tabiat]: pengepala 'Hari ini', empat kad tabiat masing-masing dengan ikon, nama dan kiraan rentetan, bar tab bawah dengan lima ikon berlabel — semua label boleh dibaca dan dieja dengan betul, jarak gaya iOS, mod cerah."
Antara muka ialah dokumen padat teks yang menyamar. Menyenaraikan elemen melibatkan perancang; 'boleh dibaca dan dieja dengan betul' menetapkan tahap yang benar-benar akan dicapai oleh perender teks.
Tiga flagship, tiga teori: penaakulan dahulu, kelajuan dahulu, kebolehsuntingan dahulu. Prompt yang sama merentas ketiga-tiganya, dinilai berdasarkan apa yang kami akan keluarkan. Ketiga-tiganya boleh dipilih dalam penjana di atas.
ChatGPT Images 2.0, dilancarkan pada 21 April: pemikiran natif, #1 merentas setiap kategori arena dengan +242 dalam masa dua belas jam, API sebagai gpt-image-2. Versi dalam penjana di atas.
generasi kecekapan: suntingan yang lebih pantas dan lebih murah yang mengekalkan butiran; model imej OpenAI awam terbaik sehingga April.
keluarga model yang memulakan imej AI arus perdana keluar daripada ChatGPT; GPT Image 2 ialah pengganti yang ditetapkan. Jika anda datang ke sini mencari DALL·E, di sinilah jalan itu membawa anda.
Model imej utama OpenAI, dilancarkan pada 21 April 2026 sebagai ChatGPT Images 2.0 (nama API gpt-image-2). Ia merupakan model imej OpenAI pertama dengan penaakulan natif — ia merancang susun atur dan menyemak kandungan sebelum pemaparan — dengan teks berbilang bahasa yang siap cetak, kelompok konsisten 8 imej dan saiz fleksibel sehingga 2K. Ia muncul buat pertama kali di kedudukan #1 dalam setiap kategori Image Arena dengan margin terbesar yang pernah direkodkan.