让文字成为画面的一部分
模型擅长把可读文字与视觉构图一起生成,适合菜单、信息图、活动海报和图表。提示词中可分别写清标题、标签、层级与摆放位置,让文字参与设计而非只充当装饰;交付前仍应逐项校对拼写、数字与换行。
在选型前明确容量、输入输出与调用方式。
原生规格描述模型能力;本平台专用入口使用明确的画幅与分辨率选项,参考图及其他控制项按所选入口的支持范围使用。
了解 nano-banana-2 能为你的工作带来什么。
模型擅长把可读文字与视觉构图一起生成,适合菜单、信息图、活动海报和图表。提示词中可分别写清标题、标签、层级与摆放位置,让文字参与设计而非只充当装饰;交付前仍应逐项校对拼写、数字与换行。
提供原图后,可描述需要添加、移除或替换的元素,也能调整整体风格与色彩。修改产品背景、画面氛围或指定物件时,建议同时说明保留项,例如主体形状、镜头角度和构图,帮助模型理解修改边界与创作意图。
Nano Banana 2 注重多参考图处理与一致性,可将人物、产品及场景素材用于同一画面。为每张参考图指定用途,比笼统要求融合更清晰;制作系列视觉时,可重复使用核心参考素材,并逐轮检查人物特征和产品外观。
从具体任务出发,找到模型发挥作用的位置。
输入产品图片及目标场景描述,生成桌面、室内或户外陈列图。明确保留包装形状、颜色和关键标识,再调整背景、光线与配色,适合制作商品展示和广告候选图;产品尺寸关系、标签文字仍需在发布前复核。
输入活动主题、完整文案、版式层级及画幅要求,生成横版宣传图或竖版社交海报。可先确定主体与布局,再以参考图修改标题或颜色。交付物是完整图像,适合创意预览,不应视为可独立编辑文字与图层的设计文件。
使用相同人物或产品参考图,分别描述不同背景、动作和镜头,制作一组风格连贯的视觉素材。每次说明哪些特征必须保持一致,并把选定结果继续作为编辑依据,适合角色宣传、品牌内容和故事场景的逐步探索。
结合任务复杂度、输入材料与预期结果选择。
Nano Banana 2 适合同时需要多参考图处理、文字渲染和高清输出的日常创作。Nano Banana 2 Lite 更偏向速度与规模,原生仅支持 1K,且未针对多参考输入与多轮连续编辑优化。若任务包含反复换景、改字或细节调整,均衡版更贴合这一工作方式。
Nano Banana Pro 对应 Gemini 3 Pro Image,定位于更复杂的视觉任务、品牌一致性与精细创作控制;Nano Banana 2 则强调速度与质量的平衡。原版 Nano Banana 对应 Gemini 2.5 Flash Image,并非本型号的简称。选型应依据编辑复杂度和交付要求,而非仅看名称。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 nano-banana-2 时的常见疑问。
不是。Nano Banana 2 对应 Gemini 3.1 Flash Image,原版 Nano Banana 对应 Gemini 2.5 Flash Image。在本平台中调用本型号时,应明确填写 model=nano-banana-2,避免把服务名称与具体型号混用。
使用 /nano-banana/images,指定 model=nano-banana-2、action=generate、prompt,并设置 resolution=4K、aspect_ratio=9:16。这里的 4K 是分辨率档位,不应理解为所有画幅都有相同的宽高像素。
专用入口使用 action=edit,并通过 image_urls 提供图片地址及 prompt 修改指令。也可使用 /openai/images/edits 的 image 字段提交单个图片 URL 或数组,显式填写本型号,并清楚区分需要修改和保留的内容。
原生模型支持最多混合 14 张参考图,但该数字不是所有调用入口的上传数量保证。实际使用应遵循入口支持范围,并为素材说明人物、产品或背景等用途;不要把请求数组的校验上限直接视为模型能力上限。
专用入口的结果图片位于 data[].image_url,并包含 task_id 与 trace_id;请求也支持 async 和 callback_url。继续编辑时,可将选定结果的图片地址作为新输入,说明下一步修改,逐步完成构图、文字和色彩调整。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。