Le modèle phare d’OpenAI pour l’image : il réfléchit avant de dessiner — planifie la mise en page et vérifie le contenu — et rend du texte que vous pourriez envoyer à l’impression. Saisissez un prompt ci-dessous et essayez-le.
Développeur
OpenAI
Expédié comme
Images ChatGPT 2.0 / gpt-image-2
Signature
Mode de réflexion natif
Texte dans l’image
Prêt à imprimer · multilingue
Lots
8 images, cohérentes
Sortie max
2K
Niveau ici
Crédits payants
Notre verdict en une ligne : le choix pour la mise en page. Lorsque l’image est en réalité un document — un menu, une affiche, une maquette UI, tout élément dont les mots et la structure doivent résister à un examen minutieux — ce modèle le planifie avant de le dessiner.
GPT Image 2 est arrivé en avril et a pris la première place dans chaque catégorie d’Image Arena en moins de douze heures — avec 242 points d’avance, le plus grand écart jamais enregistré par le classement. La raison architecturale est la partie intéressante : c’est le premier modèle d’image d’OpenAI doté d’un raisonnement natif, qui planifie la mise en page et vérifie le contenu avant le rendu, ce qui explique pourquoi son tour de force est celui qui était historiquement impossible — un menu de restaurant où chaque plat est orthographié correctement et où chaque prix est aligné. Une remarque opportune : OpenAI retire l’ancien DALL·E le 30 août, et c’est ce modèle qui l’a remplacé.
Évalué à partir de nos propres rendus et du dossier publié, révisé à mesure que les faits évoluent — c'est une fonctionnalité de cette page, pas une clause de non-responsabilité.
• Réflexion avant le dessin.
Le raisonnement natif planifie la composition et vérifie le contenu avant le rendu — les mises en page complexes, les scènes à plusieurs éléments et les piles d’instructions réussissent beaucoup plus souvent du premier coup.
• Texte prêt à imprimer.
Menus, affiches, emballages, maquettes d’UI — multilingues, correctement orthographiés, correctement formatés. Le mode d’échec qui a défini les images IA pendant des années, traité comme une zone résolue.
• Lots cohérents de 8 images.
Une requête, huit variations qui préservent le caractère et le style — le flux d’itération et d’A/B est intégré au modèle, plutôt que greffé après coup.
• La voie de l'image du document.
Tout ce qui est en réalité un document — certificats, étiquettes, diapositives, maquettes publicitaires — est le terrain où la couche de raisonnement surpasse visiblement les concurrents fondés sur la correspondance de motifs.
• Réfléchir prend du temps.
Le raisonnement ajoute une latence réelle par rapport aux concurrents de classe flash. Pour une idéation rapide, ébauchez ailleurs et apportez ici la mise en page finale.
• Plafond de 2K.
Les flux de travail 4K et d’impression au-delà de 2K de Nano Banana nécessitent une mise à l’échelle ou un autre modèle. Pour la plupart des écrans, sans importance; pour le grand format, décisif.
• Une couronne d’avril dans un marché d’août.
La marge de +242 a été mesurée avant l'arrivée de Seedream 5.0 Pro et de la vague estivale. Toujours dans l'élite — mais considérez 'la plus grande avance de tous les temps' comme de l'histoire, pas comme le classement actuel.
• Aucun ancrage web.
Il raisonne à partir de connaissances, pas d’une recherche en direct — le visuel d’un produit actuel ou de l’actualité de ce matin peut revenir daté. L’ancrage de Nano Banana 2 couvre ce créneau.
Copiez dans le générateur ci-dessus, échangez les crochets, effectuez le rendu.

"Un menu de bistrot prêt à imprimer, A4 portrait : '[LUNE — Cuisine de quartier]' comme en-tête, cinq plats principaux avec les prix ($14–$22, alignés à droite), trois desserts, une courte carte des vins, une traduction française sous chaque nom de plat. Papier crème chaleureux, composition typographique classique avec empattements, aucune faute d’orthographe."
Un texte structuré dense avec des règles de mise en forme est exactement ce à quoi sert le mode de réflexion — le modèle ébauche la mise en page avant de rendre un pixel. La démo à côté du générateur est cette invite.

Lot ×8 → "[Product] visuel hero, éclairage de studio : huit variations explorant l’angle et la couleur de l’arrière-plan — même échelle du produit, même orientation de l’étiquette, même douceur de l’ombre dans les huit."
Nommer ce qui doit rester identique fait d’un lot une expérience contrôlée plutôt que huit loteries. Choisissez le gagnant, puis effectuez-en à nouveau le rendu seul en taille réelle.

"Un écran d’application mobile épuré pour [un suivi des habitudes] : en-tête 'Aujourd’hui', quatre cartes d’habitudes avec chacune une icône, un nom et un compteur de série, une barre d’onglets inférieure avec cinq icônes libellées — tous les libellés lisibles et correctement orthographiés, espacement de style iOS, mode clair."
Les interfaces sont des documents denses en texte déguisés. L’énumération des éléments mobilise le planificateur; 'lisible et correctement orthographié' fixe le niveau que le moteur de rendu de texte atteindra réellement.
Trois fleurons, trois théories : priorité au raisonnement, priorité à la vitesse, priorité à la modifiabilité. Les mêmes prompts pour les trois, jugés selon ce que nous mettrions en production. Tous les trois sont sélectionnables dans le générateur ci-dessus.
ChatGPT Images 2.0, lancé le 21 avril : réflexion native, #1 dans chaque catégorie de l’arène avec +242 en douze heures, API sous le nom gpt-image-2. La version dans le générateur ci-dessus.
la génération de l’efficacité: des retouches plus rapides et moins chères qui préservaient les détails; le meilleur modèle d’images OpenAI public jusqu’en avril.
la famille de modèles qui a lancé les images IA grand public quitte ChatGPT; GPT Image 2 est son successeur désigné. Si vous êtes arrivé ici en cherchant DALL·E, c’est là que mène cette route.
Le modèle d’image phare d’OpenAI, lancé le 21 avril 2026 sous le nom ChatGPT Images 2.0 (nom d’API gpt-image-2). C’est le premier modèle d’image d’OpenAI doté d’un raisonnement natif — il planifie la mise en page et vérifie le contenu avant le rendu — avec du texte multilingue prêt pour l’impression, des lots cohérents de 8 images et des tailles flexibles jusqu’à 2K. Il a fait ses débuts à la 1re place dans toutes les catégories d’Image Arena, avec la plus grande marge jamais enregistrée.