
Nano Banana Pro 指南:生成与编辑 AI 图像
On this page
替换天空是一个相当简单的编辑。但要从多个参考图、产品细节和文本块中重构一张活动宣传图,对模型的要求就高得多。使用 Nano Banana Pro,您需要保持构图、一致性和书面指令的协调一致。
本指南将介绍如何使用 Nano Banana Pro 生成和编辑图像、为每个参考图赋予明确的角色,以及审查发生了哪些变化。它还将解释在什么情况下 Nano Banana 2 可能是更实用的选择。
什么是 Nano Banana Pro?

Nano Banana Pro 是 Google DeepMind 基于 Gemini 3 Pro 构建的图像生成和编辑模型。其官方 API 名称为 Gemini 3 Pro Image,模型代码为 gemini-3-pro-image。谷歌的 Gemini 3 Pro Image 文档列出了文本和图像输入、图像输出、搜索接地(grounding)以及思考支持。
您应该在什么时候使用 Nano Banana Pro?
Nano Banana Pro 适用于需要协调多个视觉要求的工作。
复杂的图像生成
对于密集的场景、图表、本地化图形或具有多个关联指令的布局,请选择 Pro。谷歌将其定位为适用于复杂工作的模型,这些工作能从更强的推理能力、世界知识和精确的创意控制中受益。
专业图像编辑
它适用于现有产品、人物或构图必须在重大修改中保留下来的编辑。在 Nano Banana Pro 图像编辑过程中,简报必须明确指出需要保护的细节;模型无法猜测哪些内容已经获得批准。
产品、营销和文本密集的视觉效果
产品样机、海报、菜单和活动图形都能从其文本和布局能力中受益。将每个标签、价格、免责声明和徽标都视为需要审查的内容。
什么时候 Nano Banana 2 就足够了

谷歌将 Nano Banana 2 描述为一个在生成、编辑、文本和多参考图方面更快的通用模型。对于日常修改和快速迭代,它可能就足够了。当简报需要更复杂的推理或专业控制时,请使用 Pro。
如何使用 Nano Banana Pro 生成图像
从一份清晰的视觉简报开始
实用的 Nano Banana Pro 提示词应指明资产、受众、投放位置和一个主要信息。它们还将灵活的创意选择与需要批准的事实或品牌细节区分开来。
围绕最终用途构建提示词
“创建一张产品图像”会让模型自行选择层级。而“创建一张 4:5 的发布图像,瓶子居中,上方留出标题空间”则将提示词与真实的投放目的地联系起来。
设置构图、风格和输出格式
描述主体、动作、构图、光线、环境和预期风格。谷歌的 Nano Banana Pro 提示词技巧使用了相同的实用分类。只有在布局目标明确之后,再添加宽高比和所需的解析度。

生成并评估变体
对照一个简短的清单来比较变体:焦点、构图、文本、受保护的细节和目的地裁剪。如果一个更具戏剧性的版本削弱了产品或信息,那么它就毫无用处。
如何使用 Nano Banana Pro 编辑图像
上传清晰的源图像
打开 Loova AI 图像编辑工作区,选择 Nano Banana Pro,并上传可用的最佳源文件。使用您可以提交和修改的素材。请勿将机密或未获批准的资产上传到网络。

明确必须保持不变的内容
编辑提示词需要一个修改列表和一个保留列表。指明已经符合要求的面部、产品形状、标签、姿势、裁剪、颜色或背景元素。
一次只做一个实质性的修改
在修改标题或相机角度之前,先修改背景。如果一个请求同时修改了三个主要元素,那么下一张图像将无法显示是哪条指令导致了偏差。
通过多轮对话微调图像
谷歌的 图像生成指南 推荐使用对话式的多轮编辑。保留最后一张审核通过的图像作为上下文,并提出针对性的后续请求。如果界面启动了新任务,请再次上传该审核通过的版本。
审查面部、产品、文本和徽标
将编辑后的图像与源图并排检查,而不是凭记忆。放大面部特征、包装几何形状、小文本、徽标、手部和重复的对象。在需要像素级精确度时,稍后再添加确切的法律文本或源徽标。
如何有效使用参考图像
根据目的选择参考图
每个参考图都应该回答一个问题。源图可以定义主体、产品、姿势、构图、调色板、纹理或风格。移除没有明确角色的图像。
区分主体、产品和风格参考图
在提示词中按数字标记参考图:“图像 1 定义瓶子;图像 2 定义手部姿势;图像 3 仅提供颜色和光线。”谷歌文档记录了多参考图支持,而 Loova AI 图像到图像 目前提供多图工作流。

解决冲突的参考细节
当两个源图在颜色、形状、相机角度或排版上不一致时,声明以哪一个为准。建立层级比添加另一个描述性形容词更有用。
两个实用的 Nano Banana Pro 示例
创建产品营销图像
为上传的气泡水罐创建一张 4:5 的发布视觉图。
将水罐垂直放置在淡色石块上,左侧有柔和的晨光。
在上方三分之一处留出干净的标题空间。使用图像 1 作为确切的产品
参考,图像 2 仅用于温暖的调色板。保留水罐形状、
徽标位置、口味名称、排版布局和相机角度。不添加新的声明。
编辑带有文本的活动视觉图
编辑上传的活动图像以生成西班牙语版本。仅替换
标题为“SABOR PARA COMPARTIR”,保持相同的位置、大小、乳白色、
和无衬线风格。保持人物、产品、背景、裁剪、阴影、徽标
以及所有其他文本不变。不要翻译已注册的产品名称。
创建一次受控的 Nano Banana Pro 编辑
打开 Loova AI 图像到图像,上传一个审核通过的源文件,并为每个参考图分配单一角色。在请求另一次修改之前,先保存第一个可接受的图像。

常见的 Nano Banana Pro 问题与解决方法
| 问题 | 针对性解决方法 |
|---|---|
| 受保护的细节发生偏差 | 重复保留列表,并返回到最后一张审核通过的图像。 |
| 文本错误或拥挤 | 在双引号中提供确切的文本,并定义其位置。 |
| 参考图冲突 | 标记每个源图,分配一个角色,并声明在冲突时以哪个源图为准。 |
| 场景感觉过度修饰 | 在添加新细节之前,移除次要的风格指令。 |
| 后续编辑破坏了布局 | 将修改拆分为每轮只做一个实质性修改。 |
局限性、SynthID 和使用权
复杂的提示词仍可能产生错误的文本、改变的产品或虚构的事实细节。审查每个生产资产,尤其是图表、价格、标签、面部和徽标。
谷歌表示,生成的 Gemini 图像包含 SynthID。SynthID 系统嵌入了谷歌技术可以检测到的隐形水印,包括通过 Gemini 验证检查。检测到标记表明有谷歌 AI 的参与;它并不确立作者身份、准确性或使用每个描绘元素的许可。
仅使用您有权上传和转换的参考图。Loova AI 当前的 使用条款 规定用户对提交的用户内容负责。在商业发布之前,请确认源许可、肖像权同意、商标使用以及目的地平台的规则。
常见问题
Nano Banana Pro 可以编辑多张参考图像吗?
可以。谷歌的 API 文档描述了 Gemini 3 Pro Image 最多支持 14 张参考图像,并对对象、角色和风格分别设置了上限。产品界面可能会显示较少的输入框,因此请根据您所使用的工作区中可用的控制项进行规划。
为什么 Nano Banana Pro 会改变我要求保留的部分?
该模型是重新生成图像,而不是锁定每个未改变的像素。当保留列表含糊不清或一个提示词请求多个重大修改时,发生偏差的可能性就会增加。返回到最后一张审核通过的版本,并重新声明受保护的细节。
Nano Banana Pro 能理解不同语言的提示词吗?
能。谷歌当前的指南列出了英语、中文、日语、韩语、西班牙语、葡萄牙语和其他几种语言以获得最佳性能。对于文本密集的图像,请提供最终语言的确切文本,并在修改艺术作品之前检查拼写。
Nano Banana Pro 图像是否包含可检测的 AI 水印或 SynthID 标记?
谷歌表示,所有生成的图像都包含隐形的 SynthID 水印。它不打算让观众看到,但谷歌的检测工具可以检查它。检测有助于追溯来源;它并不证明索赔、许可或图像在其他方面是真实的。
一个精美的结果表明 Nano Banana Pro 提示词可以起作用。但它并不能说明在下一次编辑中,每个受保护的细节能有多可靠地保留下来。