OpenAI的影像旗艦:它在繪製前會先思考—規劃版面並檢查內容—並算繪出可直接送去列印的文字。在下方輸入提示詞試試看。
開發者
OpenAI
配送為
ChatGPT圖像2.0 / gpt-image-2
簽名
原生思考模式
圖片中的文字
可直接列印 · 多語言
批次
8張圖片,一致
最大輸出
2K
等級在此
付費點數
我們的一句話結論: 版面配置之選。當影像其實是一份文件——菜單、海報、UI模型,或任何文字和結構都必須經得起仔細檢視的內容——這個模型會先規劃,再繪製。
GPT Image 2於4月問世,並在12小時內拿下每個Image Arena類別的第1名—以242分之差,創下排行榜有史以來最大的差距。有趣的是其架構上的原因:它是OpenAI首款具備原生推理能力的圖像模型,會在渲染前規劃版面並檢查內容,這也就是為什麼它的拿手絕活是過去幾乎不可能做到的事—一份餐廳菜單中每道菜都拼寫正確,而且每個價格都對齊。及時提醒:OpenAI將於8月30日淘汰舊版DALL·E,而這就是取而代之的模型。
根據我們自己的渲染圖和已發布紀錄進行判斷,並隨著事實變化而修訂 — 這是本頁面的一項功能,而不是免責聲明。
• 繪製前正在思考。
原生推理會規劃構圖並在算繪前驗證內容 — 複雜版面配置、多元素場景和指令堆疊更常能一次成功。
• 可列印文字。
選單、海報、包裝、UI樣稿—多語言、拼字正確、格式妥善。多年來定義AI影像的失敗模式,被視為已解決的領域。
• 一致的8張圖片批次。
一次請求,八種保持角色和風格的變體——迭代和A/B工作流程內建於模型中,而不是事後附加。
• 文件影像通道。
任何本質上是文件的東西 — 證書、標籤、投影片、模擬廣告 — 都是推理層明顯勝過依賴模式比對的競爭對手的領域。
• 思考需要時間。
與flash級別的競爭對手相比,推理會增加實際延遲。若要快速構思,請在其他地方起草,然後將最終版面帶到這裡。
• 2K上限。
Nano Banana的4K工作流程和2K以上的列印工作流程需要放大處理或不同模型。對於大多數螢幕來說無關緊要;對於大幅面來說至關重要。
• 八月市場上的四月王冠。
+242的優勢是在Seedream 5.0 Pro和夏季浪潮到來之前測得的。依然頂尖——但請將'史上最大領先'視為歷史,而不是目前排名。
• 無網路依據。
它根據知識推理,而不是即時搜尋—當前產品或今早新聞的視覺內容可能會傳回過時結果。Nano Banana 2的事實錨定涵蓋了這一場景。
複製到上方的產生器中,交換括號,算繪。

"一份可直接印刷的小酒館菜單,A4直式: '[LUNE — 鄰里廚房]'作為頁首,五道主菜及價格($14–$22,靠右對齊),三道甜點,一份簡短酒單,每道菜名下方有法文翻譯。暖奶油色紙張,經典襯線字體排版,無拼寫錯誤。"
帶有格式規則的密集結構化文字正是思考模式的用途—模型會在渲染像素之前先草擬版面配置。產生器旁邊的示範就是此提示。

批次×8 → "[Product]主視覺圖,棚拍燈光:探索角度和背景顏色的八種變化—八張中產品比例相同、標籤方向相同、陰影柔和度相同。"
明確哪些內容必須保持一致,會讓一批生成變成受控實驗,而不是八次抽獎。選出勝者,然後單獨以完整尺寸重新算繪它。

"用於[習慣追蹤器]的簡潔行動應用程式畫面:標題'Today',四張習慣卡片,每張都有圖示、名稱和連續打卡次數,底部標籤列帶有五個附標籤的圖示 — 所有標籤清晰可讀且拼寫正確,iOS風格間距,淺色模式。"
介面是偽裝成其他形式的文字密集型文件。列舉元素會調動規劃器;'清晰易讀且拼寫正確'設定了文字渲染器實際會達到的標準。
三款旗艦,三種理論:推理優先、速度優先、可編輯性優先。三者使用相同提示詞,以我們會發布的標準來評判。三者都可在上方產生器中選擇。
ChatGPT Images 2.0,4月21日推出:原生思考,十二小時內以+242位列所有arena類別#1,API為gpt-image-2。上方生成器中的版本。
效率一代:更快、更便宜的編輯,同時保留細節;直到4月都是最好的公開OpenAI圖像模型。
開啟主流AI圖像時代的模型家族退出ChatGPT;GPT Image 2是其指定繼任者。如果你是來這裡尋找DALL·E的,這條路就通向這裡。
OpenAI的旗艦影像模型,於2026年4月21日以ChatGPT Images 2.0(API名稱gpt-image-2)推出。這是首款具備原生推理能力的OpenAI影像模型——會在渲染前規劃版面並檢查內容——支援可直接印刷的多語言文字、8張影像的一致批次,以及最高2K的彈性尺寸。它在Image Arena每個類別中都以有史以來最大差距首次登上#1。