Il modello di punta di OpenAI per le immagini: pensa prima di disegnare — pianifica il layout e controlla i contenuti — e renderizza testo che potresti mandare in stampa. Digita un prompt qui sotto e provalo.
Sviluppatore
OpenAI
Spedito come
Immagini ChatGPT 2.0 / gpt-image-2
Firma
Modalità di pensiero nativa
Testo nell'immagine
Pronto per la stampa · multilingue
Batch
8 immagini, coerenti
Output max
2K
Livello qui
Crediti a pagamento
Il nostro verdetto in una riga: la scelta per il layout. Quando l’immagine è in realtà un documento — un menu, un poster, un mockup UI, qualsiasi cosa in cui parole e struttura debbano resistere a un esame attento — questo modello la pianifica prima di disegnarla.
GPT Image 2 è arrivato ad aprile e ha conquistato il primo posto in ogni categoria di Image Arena entro dodici ore — con un distacco di 242 punti, il margine più ampio mai registrato dalla classifica. Il motivo architetturale è la parte interessante: è il primo modello di immagini di OpenAI con ragionamento nativo, che pianifica il layout e verifica il contenuto prima del rendering, motivo per cui il suo pezzo forte è quello storicamente impossibile — un menu di ristorante in cui ogni piatto è scritto correttamente e ogni prezzo è allineato. Una nota tempestiva: OpenAI ritira il vecchio DALL·E il 30 agosto, e questo è il modello che lo ha sostituito.
Valutato in base ai nostri rendering e al registro pubblicato, rivisto man mano che i fatti cambiano — questa è una caratteristica di questa pagina, non una dichiarazione di esclusione di responsabilità.
• Sto pensando prima di disegnare.
Il ragionamento nativo pianifica la composizione e verifica i contenuti prima del rendering — layout complessi, scene con più elementi e stack di istruzioni riescono al primo tentativo molto più spesso.
• Testo pronto per la stampa.
Menu, poster, packaging, mockup UI — multilingue, con ortografia corretta, formattati correttamente. La modalità di errore che ha definito le immagini AI per anni, trattata come un’area risolta.
• Batch coerenti da 8 immagini.
Una richiesta, otto varianti che mantengono carattere e stile — il flusso di iterazione e A/B è integrato nel modello, non aggiunto in un secondo momento.
• La corsia dell'immagine del documento.
Tutto ciò che in realtà è un documento — certificati, etichette, slide, mockup pubblicitari — è l’ambito in cui il livello di ragionamento surclassa visibilmente i rivali basati sul confronto di pattern.
• Pensare richiede tempo.
Il ragionamento aggiunge una latenza reale rispetto ai rivali di classe flash. Per un'ideazione rapida, crea la bozza altrove e porta qui il layout finale.
• Limite 2K.
I flussi di lavoro 4K e di stampa oltre 2K di Nano Banana richiedono upscaling o un modello diverso. Per la maggior parte degli schermi, irrilevante; per il grande formato, decisivo.
• Una corona d'aprile in un mercato d'agosto.
Il margine di +242 è stato misurato prima dell'arrivo di Seedream 5.0 Pro e dell'ondata estiva. Ancora élite — ma considera 'il vantaggio più grande di sempre' come storia, non come la classifica attuale.
• Nessun grounding web.
Ragiona a partire dalla conoscenza, non dalla ricerca live — un visual di un prodotto attuale o delle notizie di questa mattina può risultare datato. Il grounding di Nano Banana 2 copre quel caso.
Copia nel generatore sopra, scambia le parentesi, renderizza.

"Un menu da bistrot pronto per la stampa, A4 verticale: '[LUNE — Cucina di quartiere]' come intestazione, cinque piatti principali con prezzi ($14–$22, allineati a destra), tre dessert, una breve carta dei vini, una traduzione francese sotto il nome di ogni piatto. Carta color crema caldo, composizione tipografica classica con caratteri serif, nessun errore di ortografia."
Il testo strutturato denso con regole di formattazione è esattamente ciò per cui esiste la modalità di ragionamento — il modello abbozza il layout prima di renderizzare un pixel. La demo accanto al generatore è questo prompt.

Batch ×8 → "[Product] immagine hero, illuminazione da studio: otto varianti che esplorano angolazione e colore dello sfondo — stessa scala del prodotto, stesso orientamento dell'etichetta, stessa morbidezza dell'ombra in tutte e otto."
Indicare ciò che deve restare identico trasforma un batch in un esperimento controllato invece che in otto lotterie. Scegli il vincitore, quindi renderizzalo di nuovo da solo a dimensione piena.

"Una schermata pulita di app mobile per [un tracker di abitudini]: intestazione 'Oggi', quattro schede abitudine ciascuna con icona, nome e conteggio della serie, una barra delle schede inferiore con cinque icone etichettate — tutte le etichette leggibili e scritte correttamente, spaziatura in stile iOS, modalità chiara."
Le interfacce sono documenti densi di testo sotto mentite spoglie. Enumerare gli elementi attiva il pianificatore; 'leggibile e scritto correttamente' stabilisce l'asticella che il renderer di testo raggiungerà davvero.
Tre flagship, tre teorie: prima il ragionamento, prima la velocità, prima la modificabilità. Gli stessi prompt per tutti e tre, valutati in base a ciò che rilasceremmo. Tutti e tre selezionabili nel generatore qui sopra.
ChatGPT Images 2.0, lanciato il 21 aprile: pensiero nativo, #1 in ogni categoria dell'arena con +242 entro dodici ore, API come gpt-image-2. La versione nel generatore sopra.
la generazione dell'efficienza: modifiche più rapide ed economiche che mantenevano intatti i dettagli; il miglior modello di immagini OpenAI pubblico fino ad aprile.
la famiglia di modelli che ha dato il via alle immagini AI mainstream esce da ChatGPT; GPT Image 2 è il suo successore designato. Se sei arrivato qui cercando DALL·E, questa è la destinazione di quel percorso.
Il modello di immagini di punta di OpenAI, lanciato il 21 aprile 2026 come ChatGPT Images 2.0 (nome API gpt-image-2). È il primo modello di immagini di OpenAI con ragionamento nativo — pianifica il layout e controlla i contenuti prima del rendering — con testo multilingue pronto per la stampa, batch coerenti da 8 immagini e dimensioni flessibili fino a 2K. Ha debuttato al #1 in ogni categoria di Image Arena con il margine più ampio mai registrato.