Nano Banana Pro是什么
Nano Banana Pro是Google DeepMind推出的专业级图片生成与编辑模型,正式模型名称为Gemini 3 Pro Image。它把Gemini 3 Pro的推理、世界知识和多模态理解用于复杂视觉设计。
该模型重点提升图片内文字、信息图、产品样机、多参考图和品牌一致性,并支持最高4K输出。它仍是Nano Banana家族的高端复杂任务选择,但不等于当前唯一或速度最快的图片模型。
Nano Banana名称与模型代码
| 常用名称 | 正式模型 | API模型代码 | 定位 |
|---|---|---|---|
| Nano Banana 2 Lite | Gemini 3.1 Flash Lite Image | gemini-3.1-flash-lite-image | 速度最快、成本最低和高吞吐 |
| Nano Banana 2 | Gemini 3.1 Flash Image | gemini-3.1-flash-image | 速度、4K、文字和编辑的通用主力 |
| Nano Banana Pro | Gemini 3 Pro Image | gemini-3-pro-image | 复杂设计、世界知识、品牌与精确控制 |
| Nano Banana | Gemini 2.5 Flash Image | gemini-2.5-flash-image | 第一代旧版本,官方建议迁移 |
Google已经将gemini-3-pro-image发布为稳定版本,旧的Preview标识不应继续用于新项目。开发者还应关注发布说明,避免把消费端昵称当成固定API标识。
主要功能
- 根据复杂文字要求生成高保真图片。
- 编辑上传图片并保留指定人物、商品或布局。
- 在图片中生成更清晰、可读的多语言文字。
- 制作海报、Logo草稿、包装和产品样机。
- 把数据、说明和知识转成信息图与示意图。
- 通过Google搜索接地获取现实世界信息。
- 组合多张参考图并保持人物与物体一致性。
- 局部修改对象、相机角度、景深、光线和色彩。
- 把现有视觉内容翻译或本地化为其他语言。
- 选择多种宽高比以及1K、2K和4K输出。
- 在一次响应中交错输出文字和图片。
- 通过Gemini应用、AI Studio、API和Vertex AI使用。
文字生成图片
Nano Banana Pro适合需要模型先理解任务、再规划画面的复杂提示词。与只追求快速出图的模型相比,它更强调构图逻辑、世界知识和精细控制。
Gemini应用生成教程
- 打开Gemini应用并选择创建图片功能。
- 在模型选项中选择Thinking或对应专业图片模式。
- 描述主体、用途、受众、构图、文字和输出比例。
- 需要保持人物或商品时上传合法参考图片。
- 生成后检查文字、事实、身份特征和品牌元素。
- 继续对话,只修改一个区域或一个设计变量。
- 下载结果并在专业软件中完成最终校对。
专业提示词结构
- 任务:海报、信息图、产品样机、故事板或广告图。
- 受众:年龄、地区、语言和使用环境。
- 内容:必须出现的对象、数据、标题和说明。
- 构图:画面比例、主体位置、留白和视觉层级。
- 镜头:焦段、角度、景别、景深和相机运动感。
- 光线:时间、方向、强度、色温和阴影。
- 品牌:Logo位置、色号、字体倾向和禁用元素。
- 输出:分辨率、语言、透明需求和交付渠道。
图片内文字与多语言本地化
Nano Banana Pro提升了图片内文字的可读性,适合海报、菜单、包装、图表和界面样机。官方仍建议先确定准确文字,再要求模型把文字放入图片。
- 先单独生成并审核标题、正文和数字。
- 控制文字数量,避免整页密集小字。
- 明确语言、大小写、标点和换行位置。
- 翻译图片时要求其他元素保持不变。
- 品牌字体需确认授权,AI相似字形不等于正版字体。
- 成稿必须逐字校对,不能只看缩略图。
信息图与现实世界知识
模型可以把食谱、教学内容、数据和说明转换为信息图,也能通过Google搜索接地补充现实世界信息。搜索接地提升时效性,但不能保证所有事实和视觉表达完全准确。
- 先提供已经核实的核心数据和定义。
- 要求标明单位、日期、地区和统计口径。
- 让模型先输出文字草案,再生成信息图。
- 对天气、体育和市场数据记录生成时间。
- 医疗、法律、金融与科研信息必须人工复核。
- 图片成品中难以容纳完整来源,应另附引用清单。
多参考图与一致性
官方文档说明,Nano Banana Pro可处理最多14张输入图片,其中5张可保持较高保真度。初始产品介绍还强调可维持最多5个人物的相似性。
| 输入规模 | 官方能力说明 | 使用建议 |
|---|---|---|
| 1至5张 | 支持较高保真度参考 | 适合人物、商品和品牌素材 |
| 最多14张 | 可组合更多视觉元素 | 复杂组合中一致性可能下降 |
| 最多5个人物 | 强调人物相似性保持 | 仍需检查脸型、年龄、服装和手部 |
| 多种物体 | 可用于产品组合与场景搭建 | 明确每张参考图要保留的属性 |
多参考图操作步骤
- 只选择拥有上传和生成权的参考图片。
- 为每张图片编号并说明其用途。
- 区分必须保留与可以自由变化的内容。
- 先用少量参考图测试人物和商品一致性。
- 逐步增加背景、服装、配件和品牌元素。
- 每轮只调整一类变量并保存稳定版本。
- 放大检查面部、手部、文字、Logo和产品结构。
局部编辑与创意控制
Nano Banana Pro可以通过对话修改局部内容,并控制相机角度、焦点、景深、光线和色彩分级。生成式编辑会重新推断像素,不能保证未指定区域绝对不变。
- 把白天场景改成夜晚并保持主体。
- 改变光源方向、明暗对比和电影色调。
- 调整焦点与景深以突出特定对象。
- 扩展或缩减背景以适配新的画面比例。
- 替换服装、道具和场景中的单一元素。
- 将草图、蓝图或平面概念转成写实效果。
- 对不需要变化的区域写出明确锁定要求。
输出分辨率与比例
Nano Banana Pro支持1K、2K和最高4K图片,并提供多种常见宽高比。4K输出成本更高,也不会自动修复所有文字、纹理和结构问题。
| 输出 | 适合用途 | API标准输出价 |
|---|---|---|
| 1K | 网页草图、社交图片和快速审核 | 约0.134美元/张 |
| 2K | 较高清设计、演示和中等尺寸输出 | 约0.134美元/张 |
| 4K | 高分辨率成稿、印刷前素材和精细展示 | 约0.24美元/张 |
上述价格只计算图片输出的标准API费用,还可能包含文字输入、图片输入、思考输出和搜索接地等成本。消费端Gemini套餐不按这张API表直接结算。
交错文字与图片输出
Gemini 3 Pro Image可以在同一次响应中交错生成文字段落和插图,适合故事、教学指南和分步骤说明。开发者需要遍历响应中的内容块,不能只读取单一图片字段。
- 故事内容可以在章节之间插入对应插图。
- 教学步骤可以同时返回文字说明和示意图。
- 复杂响应需要按内容块顺序保存和渲染。
- 前端应处理缺图、重复图片和文本为空等异常。
- 每张输出图片都会计入生成成本。
Gemini应用中的使用入口
Nano Banana Pro可在Gemini网页端和移动应用中使用,通常通过创建图片并选择Thinking类模型进入。免费用户有有限额度,Google AI Plus、Pro和Ultra用户获得更高配额。
| 入口 | 可用方式 | 说明 |
|---|---|---|
| Gemini应用 | 创建图片并选择Thinking模型 | 免费额度有限,付费订阅配额更高 |
| Google AI Mode | 部分国家和语言中使用专业图片模式 | 地区、账号与套餐限制较多 |
| NotebookLM | 生成信息图和Slide Deck | 可基于用户资料与研究结果可视化 |
| Google Slides | Help me visualize与美化幻灯片 | 面向符合条件的Workspace客户 |
| Google Vids | 生成视频项目中的图片素材 | 面向符合条件的Workspace客户 |
| Flow | 生成和控制影片画面 | Nano Banana Pro面向付费方案 |
| Mixboard | 画布与演示文稿能力 | 属于Google Labs实验产品 |
水印与AI内容标识
所有Google图片生成模型输出都包含不可见的SynthID数字水印。Gemini应用中免费与Google AI Pro层级生成的图片还可能带可见Gemini标记,Ultra和AI Studio开发者输出可移除可见水印。
- 不可见SynthID用于识别Google AI生成内容。
- 移除可见标记不代表SynthID被移除。
- 平台和地区可能要求额外披露AI生成。
- 广告、新闻和公共传播应明确标注合成内容。
- 不要用AI图片冒充真实人物、事件或证据。
Google AI个人套餐
Google One当前提供Google AI Plus、Pro和Ultra三类个人AI套餐,不同地区价格、税费、赠送容量和产品配额可能不同。目录正文不应写成全球统一固定人民币价格。
| 套餐 | Nano Banana Pro相关权益 | 适合用户 |
|---|---|---|
| 免费层级 | Gemini应用有限额度,达到上限后切换其他图片模型 | 偶尔生成与功能体验 |
| Google AI Plus | 比免费层级更高的图片和AI配额 | 轻量创作与日常使用 |
| Google AI Pro | 更高Nano Banana Pro与AI Studio使用限额 | 学生、创作者和专业个人 |
| Google AI Ultra | 最高配额、更多Flow能力和专业水印权益 | 高频创作与高级实验功能 |
实际套餐价格和功能可用性应以Google One账户所在国家或地区的购买页为准。Workspace、学校和企业账号还会受到管理员许可与组织套餐限制。
Gemini API技术规格
| 项目 | Gemini 3 Pro Image |
|---|---|
| 模型代码 | gemini-3-pro-image |
| 输入类型 | 文字和图片 |
| 输出类型 | 文字和图片 |
| 输入Token上限 | 65536 |
| 输出Token上限 | 32768 |
| 图片生成 | 支持 |
| 推理Thinking | 支持 |
| Google搜索接地 | 支持 |
| Batch API | 支持 |
| Flex推理 | 支持 |
| Priority推理 | 支持 |
| Function Calling | 不支持 |
| Structured Output | 不支持 |
| URL Context | 不支持 |
| 文件搜索与缓存 | 不支持 |
| 音频与Live API | 不支持 |
Gemini API标准价格
以下为2026年8月核验Google Gemini Developer API价格页时的美元价格。Nano Banana Pro没有API免费层级,生产调用需要启用付费账号。
| 计费项目 | 标准付费价格 | 换算说明 |
|---|---|---|
| 文字或图片输入 | 2美元/百万Token | 单张输入图按560 Token,约0.0011美元 |
| 文字与思考输出 | 12美元/百万Token | 按实际输出Token计费 |
| 图片输出 | 120美元/百万Token | 1K与2K约0.134美元,4K约0.24美元 |
| Google搜索接地 | 每月5000次免费搜索请求,之后14美元/1000次 | Gemini 3.x模型共享免费额度,按实际搜索查询计 |
Batch、Flex与Priority价格
| 模式 | 输入价格 | 文字与思考输出 | 图片输出 | 适合任务 |
|---|---|---|---|---|
| Batch | 文字1美元/百万Token;单图约0.0006美元 | 6美元/百万Token | 1K或2K约0.067美元;4K约0.12美元 | 非实时批量生成 |
| Flex | 文字1美元/百万Token;单图约0.0006美元 | 6美元/百万Token | 1K或2K约0.067美元;4K约0.12美元 | 可容忍弹性容量的任务 |
| Priority | 文字或图片3.60美元/百万Token | 21.60美元/百万Token | 216美元/百万图片Token | 需要优先容量和低延迟的生产业务 |
Batch和Flex折扣明显,但响应时间与容量保障方式不同。企业还可通过Vertex AI采购,地区、承诺用量、网络和其他云服务费用需要单独计算。
API接入教程
- 在Google AI Studio创建项目并启用付费Gemini API。
- 创建API Key并只保存在后端密钥管理环境。
- 安装官方Google Gen AI SDK并固定兼容版本。
- 使用稳定模型代码gemini-3-pro-image发送最小请求。
- 配置输出图片比例、尺寸和响应模态。
- 保存响应中的文字与图片内容块。
- 记录输入、输出、接地和失败重试的真实成本。
- 增加限流、超时、指数退避和内容审核。
- 生产前测试地区、配额、延迟和数据治理。
API成本控制
- 创意探索先使用Nano Banana 2 Lite或2。
- 只把复杂高价值页面交给Pro生成。
- 预览阶段使用1K,定稿后再生成4K。
- 减少重复参考图和不必要的长提示词。
- 搜索接地只在确实需要现实信息时开启。
- 离线任务使用Batch或Flex降低图片输出成本。
- 为用户和项目设置日预算、配额和异常报警。
Nano Banana Pro与2系列怎么选
| 需求 | 推荐模型 | 原因 |
|---|---|---|
| 高吞吐快速草图 | Nano Banana 2 Lite | 速度和成本优先 |
| 通用生成与快速多轮编辑 | Nano Banana 2 | 质量、4K、文字与速度平衡 |
| 复杂信息图与世界知识 | Nano Banana Pro | 推理和搜索接地更强 |
| 品牌与多参考图高保真 | Nano Banana Pro | 精确控制和一致性优先 |
| 大批量最终输出 | 先2系列筛选,再Pro定稿 | 把高价模型集中在关键成品 |
| 旧版现有项目 | 迁移到2 Lite或2 | 官方已将第一代列为旧版本 |
适合哪些使用场景
- 设计师制作高保真海报、包装和产品样机。
- 品牌团队组合商品、人物与视觉规范。
- 教育工作者把知识和资料转换为信息图。
- 市场团队生成多语言广告与本地化素材。
- 影视团队制作故事板、场景和灯光概念图。
- 电商团队创建商品场景和不同市场版本。
- 开发者构建图片生成、编辑和设计应用。
- Workspace用户在Slides和Vids中创建视觉内容。
- NotebookLM用户把来源资料转成演示和图解。
不适合直接完成的任务
- 要求图片中所有事实和数据自动绝对准确。
- 需要精确字体文件、矢量图层和印刷色彩管理。
- 未经授权生成名人、客户或受保护角色。
- 把AI合成图当作新闻、医疗或司法证据。
- 必须完全离线且素材不能发送到云端的项目。
- 依赖固定随机结果和像素级可复现的生产管线。
- 使用免费Gemini应用图片直接进行商业发布。
- 要求模型执行函数调用或输出严格结构化数据。
产品优势
- Gemini推理和世界知识适合复杂视觉任务。
- 图片内文字和多语言本地化能力较突出。
- 支持Google搜索接地生成现实信息相关视觉。
- 最多可处理14张参考图片。
- 对人物、商品和品牌一致性提供更强控制。
- 支持局部编辑、镜头、景深、光线和色彩调整。
- 提供1K、2K和最高4K输出。
- 可交错返回文字和图片。
- 覆盖Gemini、NotebookLM、Workspace、AI Studio和Vertex AI。
- 稳定API模型支持标准、Batch、Flex和Priority模式。
使用限制与注意事项
- Nano Banana Pro不是当前速度最快或价格最低的型号。
- API没有免费层级,输入、输出和接地都会产生费用。
- 4K单图输出价格高于1K和2K。
- 模型不一定严格按要求返回指定图片数量。
- 最多14张输入不代表每张都能保持同等高保真。
- 图片文字仍可能拼写错误或布局不合理。
- 搜索接地可能产生多次查询并分别计费。
- 模型不支持音频输入、函数调用和结构化输出。
- 消费端配额、入口和水印会随套餐与地区变化。
- 生成结果可能含有事实错误、偏见或不适当元素。
- 第三方商标、角色、人物与参考图权利由用户负责。
隐私与数据安全
Gemini API价格页标明,Nano Banana Pro付费层级的数据不会用于改进Google产品。消费端Gemini、Workspace和Vertex AI适用不同的数据条款,不能把API付费保护直接套用到所有入口。
- 敏感业务优先使用企业合同与受管控的Vertex AI环境。
- 不要把API Key放入浏览器、移动应用和公开代码。
- 上传人物、商品和客户素材前取得明确授权。
- 删除图片中的位置、设备和个人身份信息。
- 记录参考图、提示词、模型版本和生成时间。
- 为团队设置最小权限、预算和日志访问控制。
- 依据业务地区核对数据驻留、保留和删除规则。
GitHub与开源状态
Nano Banana Pro模型权重、训练数据和Google托管服务没有开源。Google在GitHub公开了官方Google Gen AI Python SDK和Gemini Cookbook,均采用Apache 2.0许可证。
SDK与示例开源不代表模型开源,也不允许脱离Google服务本地运行Gemini 3 Pro Image。开发者仍需API Key、付费账号和符合Google条款的云端调用。
基本信息
| 字段 | 内容 |
|---|---|
| 产品名称 | Nano Banana Pro |
| 正式模型名称 | Gemini 3 Pro Image |
| 开发方 | Google DeepMind |
| 稳定API代码 | gemini-3-pro-image |
| 工具类型 | AI图片生成、编辑与多模态视觉模型 |
| 输入 | 文字与图片 |
| 输出 | 文字与图片 |
| 最高分辨率 | 4K |
| 参考图 | 最多14张,其中5张高保真 |
| 搜索接地 | 支持Google搜索 |
| 主要入口 | Gemini、AI Studio、Gemini API、Vertex AI及Google产品 |
| 是否提供API | 是,付费层级 |
| 是否开源 | 模型不开源;官方SDK与Cookbook采用Apache 2.0 |
| AI内容标识 | 所有生成图片包含SynthID |
推荐指数
4.8 / 5。Nano Banana Pro在复杂视觉推理、多语言文字、信息图、多参考图和品牌控制方面能力完整,并提供稳定API;但成本、事实核验、权限、水印与版权治理仍是专业使用的必要环节。
常见问题
Nano Banana Pro的正式名称是什么?
正式名称是Gemini 3 Pro Image,稳定API模型代码为gemini-3-pro-image。Nano Banana Pro是Google使用的产品昵称。
Nano Banana Pro还是最新模型吗?
它仍是家族中面向最复杂专业任务的高端模型,但Google已经推出速度更快的Nano Banana 2和2 Lite。不同模型针对质量、速度和成本做了不同取舍。
可以免费使用吗?
Gemini应用向免费用户提供有限的Nano Banana Pro额度,达到上限后会切换其他图片模型。Gemini API没有该模型的免费层级。
API生成一张图片多少钱?
标准API中1K或2K图片输出约0.134美元,4K约0.24美元,还需计算输入、文字与思考输出以及可能的搜索接地费用。
最多可以上传多少张参考图?
官方文档列出最多14张输入图片,其中5张支持较高保真度。复杂组合仍需人工检查人物和物体一致性。
支持中文文字生成吗?
支持中文等多种语言,并改进了图片内文字与本地化能力。正式成稿仍应逐字校对。
生成图片有水印吗?
所有输出都有不可见SynthID。Gemini消费端部分套餐还有可见标记,Ultra和AI Studio等入口可提供无可见水印画面。
Nano Banana Pro开源吗?
模型不开源。Google官方SDK和Cookbook开源并采用Apache 2.0许可证,但仍需调用Google托管模型。
桂公网安备45132202000164号