
真的能把字拼對的畫面內文字
這就是它值得比更便宜的模型多花錢的理由。我們讓它做了海報主標題、四階段資訊圖、韓文展覽標題和一圈包覆式產品標籤。每一處要求的文字都拼寫正確,而且落在提示詞指定的位置上。資訊圖還不只是拼對:循環上那幾處流向標註——低壓蒸氣、高壓氣體、高壓液體、低壓液體——在熱力學上的位置也是對的。它不是畫了個看起來像示意圖的東西,它畫對了那張圖。
Nano Banana Pro 能把可讀的文字畫進圖裡,並融合最多五張參考圖——在瀏覽器裡就能用,不用 API key,也不用開 Google Cloud 專案。
Nano Banana Pro 就是 Google 的 Gemini 3 Pro Image,2025 年 11 月 20 日發表。它與其他影像模型拉開距離的地方在文字:Google 稱它是把正確、清晰的文字直接畫進圖裡最強的模型,我們自己的實測大致印證了這一點。在這裡它支援文生圖與圖生圖,最多可接 5 張參考圖片,能輸出 1K、2K 或 4K。
它有一條硬邊界,而我們把這條線的位置找準了。短文字是可靠的——標題、標籤、圖說、約三十字的導言,全都拼寫正確。兩整欄內文則完全是亂碼。下面那張雜誌跨頁就是這次失敗,原樣呈現。另外,畫面裡多人交疊時,單隻手都沒問題,但它們之間的空間關係會失去邏輯。
定位與能力說法出自 Google 官方發表: Introducing Nano Banana Pro
“Nano Banana Pro 借助 Gemini 頂尖的推理能力與真實世界知識,把資訊視覺化做得前所未有地好。”
“你要是讓它生成一整頁、帶好幾段內文的雜誌內頁,照樣會得到亂碼。”
“文字準確率大約在 95%。”
下面每一張都是 2026 年 8 月 18 日在本頁生成的,2K,一次出圖,並附上原提示詞——包括失敗的那一張。

這就是它值得比更便宜的模型多花錢的理由。我們讓它做了海報主標題、四階段資訊圖、韓文展覽標題和一圈包覆式產品標籤。每一處要求的文字都拼寫正確,而且落在提示詞指定的位置上。資訊圖還不只是拼對:循環上那幾處流向標註——低壓蒸氣、高壓氣體、高壓液體、低壓液體——在熱力學上的位置也是對的。它不是畫了個看起來像示意圖的東西,它畫對了那張圖。

評測普遍的說法是「標題沒問題、內文不行」,這話沒錯,但太籠統,無法據此安排工作。所以我們讓它做了一整張雜誌跨頁,然後逐字讀了一遍。刊名、期號、頁尾、大標題:正確。約三十字的導言:完全合乎文法的英文。二十五字的圖說:正確。下面兩欄連續內文:亂碼。可用邊界大約就在一段——把主標題、導言、標籤和圖說寫進提示詞,真正的內文事後自己排。

Google 宣稱它能在多種語言裡畫出清晰可讀的文字,我們那張韓文展覽海報印證了這一點:標題「고요한 흙」四個音節塊全部形態正確,下方的英文副標題連破折號都對。不過期待要校準——這是一個短標題,而短,恰恰是這個模型可靠的長度。碰上你自己讀不懂的文字,把字串寫短,並在上線前找母語者核對。
同一批(2026 年 8 月 18 日)裡另外五張一次成圖的結果——海報、產品、風景、美食,以及我們專門用來把它跑壞的多人場景。全部 2K,各自附上原提示詞。最快 56 秒,最慢 202 秒,中位數 86 秒。

Bold typographic gig poster: the headline 'NIGHT MARKET' in heavy condensed sans-serif across the top third, a small subtitle 'SAT 21:00 — PIER 7' beneath it, and below that a photographic scene of steam rising off a street-food griddle at night, warm amber lamps against deep teal shadows, confident editorial layout with generous margins.

Studio product photograph of a matte ceramic coffee tumbler with a wraparound label reading 'MERIDIAN ROASTERS — SINGLE ORIGIN' in clean grotesque type, resting on brushed concrete, soft top light with one crisp specular edge, shallow depth of field, physically accurate matte glaze.

Cinematic wide shot of a lighthouse keeper walking a coastal path at dawn, low sea fog rolling across the grass, cold blue ambient light broken by the warm sweep of the lantern, anamorphic depth, muted naturalistic color grade.

Overhead editorial food photograph of a cast-iron skillet cornbread, one wedge lifted out to show the crumb, scattered flaky salt and a folded linen cloth on a weathered oak table, directional morning window light, crisp golden crust texture.

Documentary photograph of four friends around a small kitchen table mid-conversation, hands overlapping as they pass a shared dish and refill glasses, natural window light, candid unposed gestures, realistic skin texture and fabric detail.
它是一個專攻文字渲染的模型。下面這些工作,正是這份專長本身就是全部意義所在的場景。
標題、編號階段、單行圖說、流向標註,一次全部拼寫正確。我們那張熱泵示意圖連工序順序都對了——這可不是能對影像模型預設期待的事。
主標題、副標題、產品字樣、類似法務聲明的小字——都是這個模型可靠的長度。連續內文事後自己排。
在我們的韓文測試裡,非拉丁文字的短標題是正確的。把字串寫短,上線前找母語者校一遍。
用最多 5 張參考圖片做合成、改風格和定點修改。超過五張就換 Official 通道,它支援 14 張。
不用 API key,不用計費帳戶,不用主控台。如果一直沒試這個模型的原因就是那一步設定,這一頁是最短的那條路。
同一個工作區、同一份訂閱——在這幾個之間切換只需一次點擊。
| Nano Banana Pro | Nano Banana Pro Official | Nano Banana 2 | Nano Banana | |
|---|---|---|---|---|
| 底層模型 | Gemini 3 Pro Image | Gemini 3 Pro Image | 新一代融圖模型 | Gemini 2.5 Flash Image |
| 每張圖積分 | 1K 與 2K 均 40 · 4K 80 | 1K 與 2K 均 150 · 4K 240 | 1K 30 · 2K 50 · 4K 70 | 20 |
| 最高解析度 | 4K | 4K | 4K | 2K |
| 參考圖片 | 5 | 14 | 14 | 5 |
| Google 搜尋接地 | 無 | 有,每次 +10 點數 | 無 | 無 |
| 長寬比 | 7 種,另加自動 | 10 種,另加自動,最寬到 21:9 | 14 種,另加自動,最寬到 8:1 | 7 種,另加自動 |
| 畫面內文字(我們自己的實測) | 約一段以內正確;成段內文失敗 | 未實測 | 未實測 | 未實測 |
| 我們實測的速度 | 2K 下 56–202 秒,中位數 86 秒(8 次) | 未實測 | 未實測 | 未實測 |
點數、參考圖片上限、解析度與比例數量,均於 2026 年 8 月 18 日讀自我們自己的模型註冊表——比例數量不含「自動」,那是一個設定而不是一種比例。速度與文字結果是我們自己的實測,並標註了樣本數。沒測過的格子就寫沒測過,而不是從廠商頁面抄一個數字過來。
在同一個工作區中將 Nano Banana Pro 與其他圖像模型比較——一鍵即可切換。
| 模型 | Gemini 3 Pro Image(Nano Banana Pro),Google 出品——2025 年 11 月 20 日發表 |
|---|---|
| 模式 | 文生圖與圖生圖,含參考圖片引導編輯 |
| 品質分級 | 1K、2K 與 4K |
| 長寬比 | 10 種預設——1:1、2:3、3:2、3:4、4:3、4:5、5:4、16:9、9:16、21:9——外加 auto |
| 每次出圖數量 | 1 張 |
| 參考圖片 | 每次生成最多 5 張 |
| Google 搜尋接地 | 本通道不支援——需要的話請用 Nano Banana Pro Official |
| 文字渲染 | 大約一段以內可靠;連續內文會退化成亂碼 |
| 點數 | 1K 與 2K 同價,所以沒有理由跑 1K;4K 價格翻倍 |
| 實測速度 | 最快 56 秒、中位數 86 秒、最慢 202 秒——2026 年 8 月 18 日我們在 2K 下的 8 次生成 |
註冊一個免費帳號——不用 API key,不用 Google Cloud 專案,不用開通計費。本頁的生成器已經選好 Nano Banana Pro。
把你要它畫出來的字串用引號原樣寫出,並說明各自的位置:主標題、副標題、標籤、圖說。每段字串控制在大約一段以內——那是這個模型保持準確的範圍。
從 10 種比例(或 auto)裡挑一個,再選一個畫質檔。這裡 1K 和 2K 同價,所以直接跑 2K;只有要印刷時才升到 4K。確切的點數消耗會在你執行前顯示。
多數任務約一分半出結果,也有跑到三分鐘的。發出去之前先把畫面裡的文字讀一遍——如果是長段落出了錯,把它改短,而不是拿同一條提示詞再跑一次。
免費開始創作,註冊即送歡迎積分。升級解鎖進階模型、更快生成與 4K 輸出。
年繳 · $240/year
把正確、清晰的文字放進畫面裡。我們的測試中,海報主標題、四階段資訊圖、韓文展覽標題和一圈包覆式產品標籤,全部一次成圖且拼寫正確——資訊圖還把流向標註放在了熱力學上正確的順序上。如果你的需求裡有字,就該找它。
大約一段。我們生成了一整張雜誌跨頁並逐字讀過:刊名、期號、頁尾、大標題、約三十字的導言和二十五字的圖說全都是正確的英文,而下面兩欄連續內文回來的是亂碼。把主標題、導言、標籤和圖說寫進提示詞;真正的內文事後自己排。
同一個 Google 模型,不同通道,差異是具體的。本頁最多接 5 張參考圖片,提供 7 種比例,沒有 Google 搜尋接地。Official 通道支援 14 張參考圖片、10 種比例(最寬到 21:9),並且可以額外花 10 點數讓生成接入 Google 搜尋——單張的點數成本約為本頁的四倍。以文字為主的工作和日常量產選這一個;需要大量參考圖片、超寬畫幅,或畫面裡要有即時資訊時,選 Official。
從我們自己的實測看有兩件事。一是上面說的連續內文。二是同一畫面裡多人交疊:在那張四人測試裡沒有手指數量錯誤,每隻手單看都成形良好,但空間邏輯壞了——你分不清共用陶盤底下是誰的手,倒出的酒也沒落進任何一只杯子。局部站得住,局部之間的關係站不住。要麼把景別收緊,要麼減少互動人數。
短字串可以。我們那張韓文海報裡,標題四個音節塊全部形態正確,英文副標題連破折號都對。不過那是一個短標題,而短恰恰是這個模型可靠的長度。碰到你自己讀不懂的文字,把字串寫短,並在上線前找母語者核對結果。
跑 2K。在這個通道上 1K 和 2K 的點數完全一樣,所以 1K 什麼也換不來——本頁所有測試都是在 2K 下生成的。只有輸出要印刷時才上 4K,因為那一級價格翻倍。
我們在 2K 下的八次生成裡中位數是 86 秒,但跨度很大:最快 56 秒,最慢 202 秒。按一分半左右做預期,跑到三分鐘也別意外。生成是非同步的,你可以繼續做別的事,結果會連同提示詞和參數一起落進歷史紀錄。
可以,你生成的圖片可在我們的服務條款下用於個人和商業專案。提示詞內容、商標,以及你上傳的任何參考圖片的權利,仍由你自己負責。
生成前後的工作都有一鍵工具——修飾、換風格、直接分享。