Google的預設圖像模型:以Flash速度實現專業級保真度,支援512px到4K,並讓角色在整個工作流程中保持一致。在下方輸入提示詞並試用。
開發者
Google DeepMind
基礎
Gemini 3.1 Flash Image
解析度
512px – 4K
寬高比
14
一致性
5個字元 · 14個物件
接地
網路圖片搜尋
此處為層級
付費點數 · Lite免費
我們的一句話評價: 成為預設值是有原因的。以Flash速度和價格獲得Pro級輸出 — 每個圖片工作都從這裡開始,只有在特定頁面告訴你原因時才升級。
Nano Banana 2就是Google不再讓你在快速影像模型和優質影像模型之間二選一後的成果:它建構於Gemini 3.1 Flash之上,以Flash的速度和價格承載了Nano Banana Pro大部分的精細度,這也是為什麼Google在2月發布後一天內,就讓它成為Gemini應用程式、搜尋和廣告中的預設選項。實務上最重要的兩項能力:角色一致性可在一套工作流程中維持多達五個角色和十四個物件——分鏡和品牌素材組不再偏移——以及影像搜尋定錨,讓它能在繪製前先從網路擷取真實的視覺參考。
根據我們自己的渲染圖和已發布記錄判斷,隨著事實變化而修訂——這是本頁的一項功能,而不是免責聲明。
• 速度與品質的取捨,已消解。
以Flash的延遲和價格實現Pro級保真度。它之所以成為Google在各處的預設選擇,也正是它應該成為你幾乎所有圖片任務首選嘗試的原因。
• 工作流程級一致性。
最多可在多次生成中保持5個角色和14個物件穩定—這些分鏡腳本、品牌集和產品系列工作過去需要依賴大量參考資料的專家才能完成
• 圖像搜尋定位.
它可以在繪製前參考真實的網路圖像——特定地標、當前產品、真實材料——縮小'可信'與'準確'之間的差距。
• 完整生產範圍。
從512px縮圖到4K主視覺圖像,涵蓋14種長寬比,使用一套提示詞彙。一個模型涵蓋整張素材表。
• 最高事實忠實度是Pro的職責。
Google自己的劃分:密集的資訊圖表、精確的圖解和每個事實都必須準確傳達的文字密集型版面交給Nano Banana Pro。這個模型是通才,而不是專家。
• 五個字元是上限,不是建議。
超過五個有名字角色的群像場景會開始讓身分彼此混淆。將群眾場景規劃為背景質感,而不是十個主角。
• SynthID始終開啟。
每個輸出都帶有Google的隱形浮水印。對幾乎所有人都沒問題;如果你的流程禁止來源標記,則需要注意。
• 扎根需要引導。
Web圖像錨定很強大但很字面化 — 關於著名地點的未錨定提示可能會返回泛泛的結果,過度錨定的提示則會像圖庫素材。指明哪些應該真實;放開哪些應該想像。
複製到上方的產生器中,替換括號,然後渲染。

"六格故事板,每格都是同一個插畫角色:[戴紅圍巾的快遞員] — 在咖啡館櫃檯、火車月台、黃昏的屋頂、市場人群中、辦公室辦公桌前、黎明的海灘上。全程保持一致的臉部、體型和圍巾;溫暖的編輯插畫風格。"
一個提示詞中包含六個場景是一致性系統的主場——命名錨定特徵(「臉、體型和圍巾」)會告訴它哪些內容不能偏移。生成器旁邊的示範就是這個提示詞。

"一張[我們的陶瓷馬克杯]放在咖啡館桌上的產品照片,透過其後方的窗戶可以看到真實的Ponte Vecchio,晨光,淺景深 — 這座橋應該看起來像實際的橋。"
'實際的橋'是觸發圖像搜尋錨定的短語: 它會查閱真實影像,而不是臨時編造一個通用地標。讓場景有現實依據,保留你參考上傳中的產品。

"[品牌吉祥物]揮手,透明感白底平面向量風格:生成1:1頭像、16:9橫幅、9:16限時動態、21:9網站頁首——四個版本保持相同姿勢、相同比例。"
一個提示詞,四種比例,零偏移 — 這個模型比任何更高階的模型都更便宜、更快速地完成日常任務。批次處理比例,而不是按每個尺寸重新輸入提示詞。
預設模型對上其自家的專業兄弟模型和四月的競技場冠軍。三者使用相同提示,並以我們會發布的標準評判。三者都可在上方產生器中選擇。
(Gemini 3.1 Flash Image) — 2月26日推出,一天內成為Gemini、Search、Ads和Flow的預設版本;5月面向企業GA;預覽版中新增影片檔案輸入。上方產生器中的版本。
(Gemini 3 Pro Image) — 高保真級別:由推理支撐的準確性、工作室級控制、4K。對於事實性工作仍然適用;其專屬頁面會說明它何時值得支付溢價。
(Gemini 2.5 Flash Image) — 爆紅的原版:四天新增1300萬使用者,截至十月已有50億張圖片。現已成為舊版;Google建議改用第2代模型。
Google目前的主力影像模型—技術上是Gemini 3.1 Flash Image,於2026年2月26日推出。它結合Nano Banana Pro的保真度與Flash等級的速度和價格:支援512px到4K輸出、14種長寬比、每個工作流程中最多5個角色和14個物件的一致性,以及會在繪製前查詢真實網路影像的圖片搜尋依據。它是Google自家產品中的預設影像模型。