核心要点 (BLUF): Nano Banana 是一款以照片编辑而闻名的 AI 模型,其描述如下:上传一张图片,说出要更改的内容,然后获取更新后的照片。它也可以从头开始生成图像,但其标志性技巧是处理您自己的照片 - 消除混乱、交换背景、更换服装或将多个单独的照片合并到一个令人信服的框架中。

无需图层,无需遮罩,无需修饰技巧。附上照片并输入指令:“删除背景中的陌生人”、“让天空看起来像日落”、“用商务夹克替换 T 恤”。 Nano Banana 以纯文本形式读取请求并返回编辑后的帧 - 通常比您在传统照片编辑器中找到正确的按钮要快。
这适用于休闲快照和产品照片。卖沙发?将盒子和猫从镜头中清除,以便买家看到物品,而不是乱七八糟的东西。更新职业档案?将随机的自拍背景变成干净的中性背景。坚持每条指令进行一项更改——这样可以使结果易于控制和验证。
一个请求最多可以接受十张图像,这需要手动完成一个晚上的编辑:将一张照片中的人物放入另一张照片的室内装饰中,为模型穿上目录中的物品,将不同照片中的亲戚聚集到一张集体照中,或者在产品模型上尝试您的徽标。
在运行指令之前,请在指令中明确分配角色:说明哪个上传提供了人员、哪个设置以及哪些部分必须保持不变。将任务分割得越精确,输出中出现的意外就越少,花费时间和令牌的重新运行也就越少。

如果没有附件,Nano Banana的行为就像常规的文本到图像生成器:描述场景,接收图片。它尤其擅长处理逼真的摄影主题——人物、食物、室内装饰、动物、自然光下的街景——只要你在提示中明确指定所需的方式,它就能处理卡通外观、绘画风格和抽象。
对于输出,您可以选择 JPEG 和 PNG 文件以及各种比例,从正方形到 21:9 全景图,包括用于故事的垂直 9:16。当您根本不想考虑取景时,可以使用自动模式 - 模型会读取您的描述并自行构图。
要知道的关键是:编辑时,Nano Banana根据您的指令重新绘制整个图像,而不是修补单个像素。精细的细节——织物纹理、标志上的文字、背景中远处的面孔——可能会与原件略有偏差。每次编辑后检查重要的部分,并明确要求模型在重要时保留它们。
另一个典型的错误是同时请求五次编辑;有些可能会被跳过或不可预测地混合在一起。而是分步骤进行:首先是背景,然后是服装,然后是光线和颜色。每个中间版本都保存在您的生成历史中,其中任何一个都可以作为下一步的起点,直到框架正确为止。
通常是的,但由于模型重新绘制了整个框架,因此小的面部特征可能会发生一些变化。当肖像或个人资料照片等相似性至关重要时,请在说明中添加“保持面部不变”,并在使用前仔细将结果与原始结果进行比较。
是的。没有附件 Nano Banana 可用作标准文本到图像模型。选择宽高比和文件格式,用您自己的话描述场景,结果就会出现在您的生成历史记录中,可供下载或通过调整重新运行。
这是该系列的基本版本:快速编辑和生成,无需精细的分辨率控制。 Nano Banana 2 是新一代,具有更多格式选项,而 Pro 的目标是高达 4K 的最大输出质量以及密集、细节丰富的场景。