Nano Banana 提示词攻略:像写需求单一样出图,像聊天一样修图
Nano Banana 是 Google Gemini 图像模型的社区昵称,如今已被官方转正——它不藏在专业工具里,就住在你每天都在用的 Gemini 对话框中,有 Google 账号就能免费用。本攻略整理自两支实测教程:Taylor Bay Studios 的提示词公式深讲(主录屏)与 Kevin Stratvert 的新手实操(部分画面更干净,用于补充步骤)。六段式出图公式、五个修图动词、多图融合与人物一致性,每一张截图里的提示词都原样照录。
来源与致谢
本教程的截图来自 Taylor Bay Studios 的公开演示视频。每个步骤都链接到视频中的对应时间点,方便你对照学习。
Taylor Bay Studios ↗先拿到入口:Nano Banana 就在 Gemini 里
- 1
打开 Gemini,在 Tools 里选 Create images
登录 gemini.google.com,从输入框下方的 Tools 菜单里选带香蕉图标的 Create images。整个对话随即切入 Nano Banana 模式(即 Gemini 2.5 Flash 图像模型),此后你发出的每一条消息都是图像提示词。

Nano Banana 不是独立应用,而是 Gemini 对话里的一种模式。视频 2:11 处 - 2
第一条提示词不用公式,大白话就行
第一次出图,一句平实的话足够。Kevin 输入“Make an image of a cookie store on a city street.”然后点发送。注意输入框里 Image 标签处于选中状态——正是它让模型停在出图模式,而不是用文字回答你。

先跑通流程,再把字数花在刀刃上。视频 1:50 处 - 3
把结果当清单来核对
几秒钟后第一张图出炉:砖墙店面、条纹雨棚、暖色橱窗光——招牌上真的写着 Sweet Bites。Nano Banana 能渲染出可读文字,这正是后文「改招牌」技巧能成立的原因。图片上方的提示词气泡留在对话里,随时可以接着改。

第一次就渲染出可读招牌文字——这就是它的文字能力。视频 2:00 处
出图公式:六个槽位一句话
- 4
背下六段式公式
Taylor Bay 的教程把出图提示词浓缩成六个槽位:Subject + Action + Environment + Art Style + Lighting + Details。不必每次填满,但按顺序过一遍,能逼你补齐新手最容易漏掉的信息——主体在做什么、在哪、怎么拍、什么光。

它是检查清单,不是枷锁——不需要的槽位尽管删。视频 1:34 处 - 5
看一个把六个槽位填满的实例
教程的示例一句话填满所有槽位:“A young woman with freckles, smiling thoughtfully, sitting on a sunlit window seat in a cozy cafe, shot on a Canon 5D Mark IV, soft natural light, warm and inviting.”主体(有雀斑的年轻女子)、动作(微笑着坐)、环境(咖啡馆窗边)、艺术风格(佳能 5D Mark IV)、光线(柔和自然光)、细节(温暖惬意)。

相机型号在这里身兼艺术风格槽位。视频 2:20 处 - 6
每个从句都落在画面里
出图逐项对应提示词:雀斑、若有所思的微笑、窗边座位、咖啡杯、自然窗光。因为写的是相机和光位而不是模糊的氛围词,成品看起来像生活方式摄影,而不是一眼假的渲染图。公式参考就贴在输入框下方,随时核对。

提示词足够具体,模型就没有猜测空间。视频 3:50 处 - 7
直接抄 Gemini 团队的官方建议
Kevin 片尾放出了 Nano Banana 团队的建议表:描述要足够详细;想让人物保持一致,就写明保留什么、改动什么(keep face, change hair);局部修改要给出位置和大小;说清你想要的修复效果;改崩了就用最后一张满意的图开新会话;宽高比不稳定,记得显式指定;想要真实感就写明 photorealistic。

「用最后一张满意的图开新会话」是最多人错过的撤销技巧。视频 6:50 处
对话式修图:五个动词打头
- 8
修图提示词,动词开头
到了修图,教程把公式换成更精简的结构:用 Add、Change、Make、Remove、Replace 五个动词开头,再点名要改的元素和想要的结果。动词承担了主要工作量——它告诉模型保留画面其余部分,而不是重新想象一张图。

五个动词几乎覆盖你需要的所有修改。视频 6:06 处 - 9
只换一个元素,其余不动
拿房屋照片练手:“Replace the sky in the image with a light blue sky and fluffy white clouds, photo realistic.”一个动词、一个目标、一段替换描述——墙面、屋顶、草坪在下方流式生成的结果里原封不动。

结尾的 photo realistic 为贴图质感定了标准。视频 7:00 处 - 10
追着结果继续改,不用重新上传
天空蓝得过头,下一句话就是:“change the colour of the sky to a lighter blue.”对话记得上一张图,无需重新上传——Nano Banana 直接在自己的输出上再改一版,新图在查看器里替换旧图。

多轮微调,正是在聊天里做图的意义所在。视频 7:25 处 - 11
一句话改掉招牌上的文字
回到 Kevin 的对话,店面招牌写着 Sweet Bites,他想换成自己的品牌:“Name the cookie store Kevin Cookie Company.”招牌重新渲染出新店名,而街道、雨棚、橱窗、路人全都原样保留——原本要靠 Photoshop 功力的文字修改,一句话完成。

锁定场景只改文字,是 Nano Banana 的招牌绝活。视频 2:40 处
一致性与融合:换装、手办与多人脸
- 12
上传自己的照片,试火遍全网的手办提示词
修自己的照片从加号图标开始:上传或拖入一张图,再写提示词。Kevin 用的是社交媒体上爆火的那条:“Turn me into a 1/7 scale collectible figurine on a desk with toy packaging beside me.”

手办潮能成立,是因为模型把你的脸当成了固定参照。视频 3:20 处 - 13
盯着脸看——这就是一致性测试
成品把他摆上书桌变成人偶,连吸塑包装盒上也印着他的脸。往上翻对比原图:人偶的脸与上传照片明显是同一个人。这种跨图的容貌保持正是 Nano Banana 的成名原因,也是它能做角色套图的基础。

照片、人偶、包装盒,三张脸是同一个人。视频 3:48 处 - 14
两张图一起传,一句话融合
多图提示词一次可以挂两张附件。Kevin 上传自己的肖像加一件皮夹克,然后提示:“Blend these two images. Put me into the jacket so it looks like I'm actually wearing it. Match the colors, shadows, and textures so it looks realistic.”最后那句「匹配颜色、阴影和质感」是合成逼真的关键。

要告诉模型怎么融,而不只是「给我融」。视频 4:20 处 - 15
换装要把衣服点名校准
针对「一换衣服就换脸」的老毛病,Taylor Bay 的解法是具体。把新衣服参考图和人物一起上传,提示:“replace the woman's white top with the black t-shirt in the image.”点明人物、现有衣物和替换衣物,模型就没有发挥的余地。

含糊的换装会凭空造出新的人——把衣服点名点清楚。视频 9:31 处 - 16
高难度:双人照换装,两张脸都不变
压力测试是一张双人合照:“replace the woman's pink top with the red dress.”模型要选对人、凭空渲染一件从未穿过的裙子,还要钉住两张脸。它做到了——红裙自然合身,另一位女士毫发无损,这正是动词开头模式换来的稳定性。

选对人、换对衣、脸不动——模式在高压下依然成立。视频 11:26 处

