Nano Banana Pro是什麼
Nano Banana Pro是Google DeepMind推出的專業級圖片生成與編輯模型,正式模型名稱為Gemini 3 Pro Image。它將Gemini 3 Pro的推論能力、世界知識以及多模態理解功能,應用於複雜的視覺設計中。
該模型著重提升圖片中的文字、資訊圖、產品樣機、多張參考圖以及品牌一致性,並支援最高4K的輸出品質。它依然是Nano Banana系列中適用於處理複雜任務的優秀選擇,但並非目前唯一或速度最快的圖片處理模型。
Nano Banana名稱與模型代碼
| 常用名稱 | 正式模型 | API模型代碼 | 定位 |
|---|---|---|---|
| Nano Banana 2 Lite | Gemini 3.1 Flash Lite Image | gemini-3.1-flash-lite-image | 速度最快、成本最低和高吞吐 |
| Nano Banana 2 | Gemini 3.1 Flash Image | gemini-3.1-flash-image | 速度、4K、文字和編輯的通用主力 |
| Nano Banana Pro | Gemini 3 Pro Image | gemini-3-pro-image | 複雜設計、世界知識、品牌與精確控制 |
| Nano Banana | Gemini 2.5 Flash Image | gemini-2.5-flash-image | 第一代舊版本,官方建議遷移 |
Google已將gemini-3-pro-image發布為穩定版本,舊的Preview標識不應再用於新專案。開發者還應注意發布說明,避免將消費端暱稱當作固定API標識。
主要功能
- 根據複雜文字要求生成高保真圖片。
- 編輯上傳圖片並保留指定人物、商品或佈局。
- 在圖片中生成更清晰、可讀的多語言文字。
- 製作海報、Logo草稿、包裝和產品樣機。
- 把數據、說明和知識轉成資訊圖與示意圖。
- 透過Google搜尋以獲取現實世界的資訊。
- 組合多張參考圖並保持人物與物體一致性。
- 局部修改對象、相機角度、景深、光線和色彩。
- 將現有視覺內容翻譯或本地化為其他語言。
- 選擇多種寬高比以及1K、2K和4K輸出。
- 在一次響應中交錯輸出文字和圖片。
- 透過Gemini應用、AI Studio、API和Vertex AI使用。
文字生成圖片
Nano Banana Pro適合那些需要先理解任務內容,再規劃畫面的複雜提示詞。與那些只追求快速產出圖片的模型相比,它更強調構圖邏輯、世界知識以及精細的控制能力。
Gemini應用生成教學
- 打開Gemini應用,並選擇建立圖片的功能。
- 在模型選項中選擇Thinking或對應專業圖片模式。
- 描述主體、用途、受眾、構圖、文字和輸出比例。
- 需要保持人物或商品時上傳合法參考圖片。
- 生成後檢查文字、事實、身份特徵和品牌元素。
- 繼續對話,只修改一個區域或一個設計變數。
- 下載結果並在專業軟體中完成最終校對。
專業提示詞結構
- 任務:海報、資訊圖、產品樣機、故事板或廣告圖。
- 受眾:年齡、地區、語言及使用環境。
- 內容:必須出現的對象、數據、標題和說明。
- 構圖:畫面比例、主體位置、留白和視覺層級。
- 鏡頭:焦段、角度、景別、景深和相機運動感。
- 光線:時間、方向、強度、色溫和陰影。
- 品牌:Logo位置、色號、字體傾向和禁用元素。
- 輸出:解析度、語言、透明需求和交付渠道。
圖片內文字與多語言本地化
Nano Banana Pro提升了圖片內文字的可讀性,適合用於海報、菜單、包裝、圖表以及介面原型。官方仍建議先確定準確的文字內容,再要求模型將文字加入圖片中。
- 先單獨生成並審核標題、正文和數字。
- 控制文字數量,避免整頁密集小字。
- 明確語言、大小寫、標點和換行位置。
- 翻譯圖片時要求其他元素保持不變。
- 品牌字體需確認授權,AI相似字形不等於正版字體。
- 成稿必須逐字校對,不能只看縮略圖。
資訊圖與現實世界知識
模型能將食譜、教學內容、數據和說明轉換為資訊圖,也能透過 Google 搜尋來補充現實世界的資訊。搜尋功能有助於提升資訊的即時性,但無法保證所有事實與視覺呈現都完全準確。
- 先提供已經核實的核心數據和定義。
- 要求標明單位、日期、地區和統計口徑。
- 讓模型先輸出文字草稿,再生成資訊圖。
- 對天氣、體育和市場數據記錄生成時間。
- 醫療、法律、金融與科研資訊必須人工複核。
- 圖片成品中難以容納完整來源,應另附引用清單。
多參考圖與一致性
官方文件說明,Nano Banana Pro最多可以處理14張輸入圖片,其中5張圖片的品質能保持在較高水準。在最初的產品說明中,也強調了其能夠保持最多5個人物的外貌特徵一致。
| 輸入規模 | 官方能力說明 | 使用建議 |
|---|---|---|
| 1至5張 | 支持較高保真度參考 | 適合人物、商品和品牌素材 |
| 最多14張 | 可組合更多視覺元素 | 複雜組合中一致性可能下降 |
| 最多5個人物 | 強調人物相似性保持 | 仍需檢查臉型、年齡、服裝和手部 |
| 多種物體 | 可用於產品組合與場景搭建 | 明確每張參考圖要保留的屬性 |
多參考圖操作步驟
- 只選擇擁有上傳和生成權的參考圖片。
- 為每張圖片編號並說明其用途。
- 區分必須保留與可以自由變化的內容。
- 先用少量參考圖測試人物和商品一致性。
- 逐步增加背景、服裝、配件和品牌元素。
- 每輪只調整一類變數並保存穩定版本。
- 放大檢查面部、手部、文字、Logo和產品結構。
局部編輯與創意控制
Nano Banana Pro可以透過對話來修改局部內容,並能控制相機的角度、焦點、景深、光線以及色彩調整。其生成式編輯功能會重新計算像素值,因此無法保證未指定的區域完全不會發生變化。
- 把白天場景改成夜晚並保持主體。
- 改變光源方向、明暗對比和電影色調。
- 調整焦點與景深以突出特定對象。
- 擴展或縮減背景以適配新的畫面比例。
- 替換服裝、道具和場景中的單一元素。
- 將草圖、藍圖或平面概念轉成寫實效果。
- 對不需要變化的區域寫出明確鎖定要求。
輸出解析度與比例
Nano Banana Pro可支援1K、2K,以及最高4K的解析度,並提供多種常見的寬高比選項。4K格式的輸出成本較高,且無法自動修正所有的文字、紋理及結構問題。
| 輸出 | 適合用途 | API標準輸出價 |
|---|---|---|
| 1K | 網頁草圖、社交圖片和快速審核 | 約0.134美元/張 |
| 2K | 較高清設計、演示和中等尺寸輸出 | 約0.134美元/張 |
| 4K | 高解析度成稿、印刷前素材和精細展示 | 約0.24美元/張 |
上述價格僅計算圖片輸出的標準API費用,還可能包含文字輸入、圖片輸入、思考輸出和搜尋接地等成本。消費端Gemini套餐不按此API表直接結算。
交錯文字與圖片輸出
Gemini 3 Pro Image能夠在同一個回應中同時產生文字段落與插圖,因此很適用於故事、教學指南以及分步說明等用途。開發者必須逐一檢視回應中的各個內容區塊,而無法只讀取單一的圖片資料。
- 故事內容可以在章節之間插入對應插圖。
- 教學步驟可以同時返回文字說明和示意圖。
- 複雜回應需要按內容塊順序保存和渲染。
- 前端應處理缺圖、重複圖片和文本為空等異常。
- 每張輸出圖片都會計入生成成本。
Gemini應用中的使用入口
Nano Banana Pro可在Gemini網頁版及行動應用程式中使用,通常需透過建立圖片並選擇Thinking類型模型來進入。免費用戶的使用額度有限,而Google AI Plus、Pro和Ultra用戶則可獲得更高的使用額度。
| 入口 | 可用方式 | 說明 |
|---|---|---|
| Gemini應用 | 創建圖片並選擇Thinking模型 | 免費額度有限,付費訂閱配額更高 |
| Google AI Mode | 部分國家和語言中使用專業圖片模式 | 地區、帳號與套餐限制較多 |
| NotebookLM | 生成資訊圖和Slide Deck | 可基於用戶資料與研究結果可視化 |
| Google Slides | 幫我視覺化與美化幻燈片 | 面向符合條件的Workspace客戶 |
| Google Vids | 生成影片專案中的圖片素材 | 面向符合條件的Workspace客戶 |
| Flow | 生成和控制影片畫面 | Nano Banana Pro面向付費方案 |
| Mixboard | 畫布與演示文稿能力 | 屬於Google Labs實驗產品 |
水印與AI內容標識
所有Google圖片生成模型的輸出內容,都會包含無法辨別的SynthID數字水印。在Gemini應用程式中,以免費模式或Google AI Pro等級所生成的圖片,可能還會有可見的Gemini標記;而Ultra及AI Studio等級的產品,則可以移除這些可見的水印。
- 不可見SynthID用於識別Google AI生成的內容。
- 移除可見標記不代表SynthID被移除。
- 平台和地區可能要求額外披露AI生成。
- 廣告、新聞和公共傳播應明確標註合成內容。
- 不要用AI圖片冒充真實人物、事件或證據。
Google AI個人套餐
Google One目前提供Google AI Plus、Pro和Ultra三種個人AI套餐,不同地區的價格、稅費、免費容量以及產品配額可能有所差異。目錄正文中不應寫明全國統一的固定人民幣價格。
| 套餐 | Nano Banana Pro相關權益 | 適合用戶 |
|---|---|---|
| 免費層級 | Gemini應用有限額度,達到上限後切換其他圖片模型 | 偶爾生成與功能體驗 |
| Google AI Plus | 比免費層級更高的圖片和AI配額 | 輕量創作與日常使用 |
| Google AI Pro | 更高Nano Banana Pro與AI Studio使用限額 | 學生、創作者和專業人士 |
| Google AI Ultra | 最高配額、更多Flow能力及專業水印權益 | 高頻創作與高級實驗功能 |
實際的套裝服務價格及功能可用性,應以 Google One 帳戶所在國家或地區的購買頁面為準。至於 Workspace、學校及企業帳號,則還會受到管理員的許可以及組織所設定的套裝服務限制。
Gemini API技術規格
| 項目 | Gemini 3 Pro Image |
|---|---|
| 模型代碼 | gemini-3-pro-image |
| 輸入類型 | 文字和圖片 |
| 輸出類型 | 文字和圖片 |
| 輸入Token上限 | 65536 |
| 輸出Token上限 | 32768 |
| 圖片生成 | 支持 |
| 推理思考 | 支持 |
| Google搜尋接地 | 支持 |
| Batch API | 支持 |
| Flex推理 | 支持 |
| 優先級推理 | 支持 |
| Function Calling | 不支援 |
| Structured Output | 不支援 |
| URL Context | 不支援 |
| 文件搜尋與緩存 | 不支援 |
| 音頻與Live API | 不支援 |
Gemini API標準價格
以下為2026年8月核驗Google Gemini Developer API價格頁時的美元價格。Nano Banana Pro沒有API免費層級,生產調用需要啟用付費帳號。
| 計費項目 | 標準付費價格 | 換算說明 |
|---|---|---|
| 文字或圖片輸入 | 2美元/百萬Token | 單張輸入圖按560 Token,約0.0011美元 |
| 文字與思考輸出 | 12美元/百萬Token | 按實際輸出Token計費 |
| 圖片輸出 | 120美元/百萬Token | 1K與2K約0.134美元,4K約0.24美元 |
| Google搜尋接地 | 每月5000次免費搜尋請求,之後14美元/1000次 | Gemini 3.x模型共享免費額度,按實際搜尋查詢計 |
Batch、Flex與Priority價格
| 模式 | 輸入價格 | 文字與思考輸出 | 圖片輸出 | 適合任務 |
|---|---|---|---|---|
| Batch | 文字1美元/百萬Token;單圖約0.0006美元 | 6美元/百萬Token | 1K或2K約0.067美元;4K約0.12美元 | 非實時批量生成 |
| Flex | 文字1美元/百萬Token;單圖約0.0006美元 | 6美元/百萬Token | 1K或2K約0.067美元;4K約0.12美元 | 可容忍彈性容量的任務 |
| Priority | 文字或圖片3.60美元/百萬Token | 21.60美元/百萬Token | 216美元/百萬圖片Token | 需要優先容量和低延遲的生產業務 |
Batch和Flex的折扣幅度相當明顯,但其回應時間以及容量保障的方式則有所不同。企業也可以透過Vertex AI來進行採購,而地區、承諾使用的量、網路以及其他雲端服務的費用則需另行計算。
API接入教學
- 在Google AI Studio建立專案並啟用付費的Gemini API。
- 建立 API Key,並僅儲存在後端金鑰管理環境中。
- 安裝官方Google Gen AI SDK並固定相容版本。
- 使用穩定模型代碼gemini-3-pro-image發送最小請求。
- 配置輸出圖片比例、尺寸和響應模態。
- 保存響應中的文字與圖片內容塊。
- 記錄輸入、輸出、接地和失敗重試的真實成本。
- 增加限流、超時、指數退避和內容審核。
- 生產前測試地區、配額、延遲和數據治理。
API成本控制
- 創意探索先使用Nano Banana 2 Lite或2。
- 只把複雜高價值頁面交給Pro生成。
- 預覽階段使用1K,定稿後再生成4K。
- 減少重複參考圖和不必要的長提示詞。
- 搜尋接地只在確實需要現實資訊時開啟。
- 離線任務使用Batch或Flex降低圖片輸出成本。
- 為用戶和項目設定日預算、配額和異常警報。
Nano Banana Pro與2系列怎麼選
| 需求 | 推薦模型 | 原因 |
|---|---|---|
| 高吞吐快速草圖 | Nano Banana 2 Lite | 速度和成本優先 |
| 通用生成與快速多輪編輯 | Nano Banana 2 | 品質、4K、文字與速度平衡 |
| 複雜資訊圖與世界知識 | Nano Banana Pro | 推理和搜索接地更強 |
| 品牌與多參考圖高保真 | Nano Banana Pro | 精確控制與一致性優先 |
| 大批量最終輸出 | 先2系列篩選,再Pro定稿 | 把高價模型集中在關鍵成品 |
| 舊版現有項目 | 遷移到2 Lite或2 | 官方已將第一代列為舊版本 |
適合哪些使用場景
- 設計師製作高保真海報、包裝和產品樣機。
- 品牌團隊組合商品、人物與視覺規範。
- 教育工作者把知識和資料轉換為資訊圖。
- 市場團隊生成多語言廣告與本地化素材。
- 影視團隊製作故事板、場景和燈光概念圖。
- 電商團隊創建商品場景和不同市場版本。
- 開發者構建圖片生成、編輯和設計應用。
- Workspace用戶在Slides和Vids中創建視覺內容。
- NotebookLM用戶把來源資料轉成演示和圖解。
不適合直接完成的任務
- 要求圖片中所有事實和數據自動絕對準確。
- 需要精確的字體檔案、向量圖層和印刷色彩管理。
- 未經授權生成名人、客戶或受保護角色。
- 把AI合成圖當作新聞、醫療或司法證據。
- 必須完全離線且素材不能發送到雲端的项目。
- 依賴固定隨機結果和像素級可重現的生產管線。
- 使用免費Gemini應用圖片直接進行商業發布。
- 要求模型執行函數調用或輸出嚴格結構化數據。
產品優勢
- Gemini推理和世界知識適合複雜視覺任務。
- 圖片內文字和多語言本地化能力較突出。
- 支援Google搜尋,生成與現實資訊相關的視覺內容。
- 最多可處理14張參考圖片。
- 對人物、商品和品牌一致性提供更強控制。
- 支援局部編輯、鏡頭、景深、光線和色彩調整。
- 提供1K、2K和最高4K輸出。
- 可交錯返回文字和圖片。
- 覆蓋Gemini、NotebookLM、Workspace、AI Studio和Vertex AI。
- 穩定API模型支援標準、Batch、Flex和Priority模式。
使用限制與注意事項
- Nano Banana Pro並非目前速度最快或價格最低的型號。
- API沒有免費層級,輸入、輸出和接地都會產生費用。
- 4K單圖輸出價格高於1K和2K。
- 模型不一定嚴格按要求返回指定圖片數量。
- 最多14張輸入並不代表每張都能保持同等高保真。
- 圖片文字仍可能拼寫錯誤或布局不合理。
- 搜尋接地可能產生多次查詢並分別計費。
- 模型不支援音頻輸入、函數調用和結構化輸出。
- 消費端配額、入口和水印會隨套餐與地區變化。
- 生成結果可能含有事實錯誤、偏見或不適當元素。
- 第三方商標、角色、人物與參考圖的權利由用戶負責。
隱私與資料安全
Gemini API的價格頁面顯示,Nano Banana Pro的付費階層所產生的數據不會被用來改進Google的產品。消費端使用的Gemini、Workspace和Vertex AI則適用不同的數據規定,因此無法將API的付費保護機制直接套用到所有使用途徑上。
- 敏感業務優先使用企業合約與受管控的Vertex AI環境。
- 不要把API Key放入瀏覽器、行動應用和公開代碼。
- 上傳人物、商品和客戶素材前取得明確授權。
- 刪除圖片中的位置、設備和個人身份資訊。
- 記錄參考圖、提示詞、模型版本和生成時間。
- 為團隊設定最小權限、預算和日誌訪問控制。
- 依據業務地區核對數據駐留、保留和刪除規則。
GitHub與開源狀態
Nano Banana Pro模型的權重、訓練數據以及Google的託管服務都未公開開源。不過,Google已在GitHub上公開了官方的Google Gen AI Python SDK和Gemini Cookbook,這些軟體均採用Apache 2.0許可證。
SDK與範例開源並不代表模型也開源,同時也不允許在離開Google服務的環境下運行Gemini 3 Pro Image。開發者仍需API Key、付費帳號,以及符合Google條款的雲端調用方式。
基本資訊
| 字段 | 內容 |
|---|---|
| 產品名稱 | Nano Banana Pro |
| 正式模型名稱 | Gemini 3 Pro Image |
| 開發方 | Google DeepMind |
| 穩定API代碼 | gemini-3-pro-image |
| 工具類型 | AI圖片生成、編輯與多模態視覺模型 |
| 輸入 | 文字與圖片 |
| 輸出 | 文字與圖片 |
| 最高解析度 | 4K |
| 參考圖 | 最多14張,其中5張高保真 |
| 搜尋接地 | 支援Google搜尋 |
| 主要入口 | Gemini、AI Studio、Gemini API、Vertex AI及Google產品 |
| 是否提供API | 是,付費層級 |
| 是否開源 | 模型不開源;官方SDK與Cookbook採用Apache 2.0 |
| AI內容標識 | 所有生成圖片包含SynthID |
推薦指數
4.8 / 5。Nano Banana Pro在複雜的視覺推理、多語言文字處理、資訊圖表製作、多參考圖片整合以及品牌控制等方面表現出色,且提供穩定的API;不過,在成本控制、資料真實性驗證、權限管理、水印以及版權治理方面,仍是需要重視的環節。
常見問題
Nano Banana Pro的正式名稱是什麼?
其正式名稱為 Gemini 3 Pro Image,而穩定的 API 模型代碼則為 gemini-3-pro-image。Nano Banana Pro則是 Google 所使用的產品別名。
Nano Banana Pro還是最新模型嗎?
它依然是家族中用於處理最複雜專業任務的高階模型,但 Google已經推出了速度更快的 Nano Banana 2 和 2 Lite。不同的模型在品質、速度和成本方面有各自的優缺點。
可以免費使用嗎?
Gemini應用程式會為免費用戶提供有限的Nano Banana Pro額度,一旦達到上限,就會切換到其他圖片模型。而Gemini API則沒有此模型的免費版本。
API生成一張圖片要多少錢?
在標準API中,1K或2K解析度的圖片輸出費用約為0.134美元,4K解析度則約為0.24美元。此外,還需計算輸入、文字及思考過程的相關費用,以及可能的搜尋相關費用。
最多可以上傳多少張參考圖?
官方文件列出了最多14張輸入圖片,其中5張支援較高的保真度。對於複雜的組合,仍需人工檢查人物與物體的一致性。
支援中文文字生成嗎?
支援中文等多種語言,並改進了圖片內文字與本地化能力。正式成稿仍應逐字校對。
生成圖片有水印嗎?
所有輸出都有不可見的SynthID。Gemini消費端部分套餐還有可見標記,Ultra和AI Studio等入口可提供無可見水印畫面。
Nano Banana Pro是開源的嗎?
模型並未開源。Google的官方SDK和Cookbook雖然已開源,且採用Apache 2.0許可證,但仍然需要使用由Google所管理的模型。
桂公網安備45132202000164號