分享
甲木:谷歌官方Nano Banana终极提示词指南:6大常用场景 + 11个模板,一篇通关!【建议收藏】
输入“/”快速插入内容
甲木:谷歌官方Nano Banana终极提示词指南:6大常用场景 + 11个模板,一篇通关!【建议收藏】
用户4242
用户4242
2025年9月9日修改
🔗 原文链接:
https://mp.weixin.qq.com/s/WBZYi2kq...
原创 甲木Zuiyn 甲木未来派
2025年09月04日 08:40 北京
小伙伴们大家好啊,我是甲木!
最近Nano Banana(又名 Gemini 2.5 Flash Image)太火爆了,全球用户的创作欲爆棚,比如下边这个我在X上刷到的一条视频,效果非常赞,
使用Nano Banana 将著名的电影人物搬到了当代纽约的浪漫场景中!
它的原生多模态架构只需一步即可处理文本和图像,从而释放出强大的功能,如对话式编辑、多图像合成和逻辑推理。
再加上 Seedance 和 Kling 共同生成这样的视频。
这段时间就有很多小伙伴找Nano Banana的好用的提示词,用法等等,
这不,谷歌官方直接出手,推出了官方认证的Prompt最佳实践!
“
原文:
https://developers.googleblog.com/zh-hans/how-to-prompt-gemini-2-5-flash-image-generation-for-the-best-results/
甲木这就来给大家翻译整理一下~
如何写出Gemini 2.5 Flash图像生成Prompt以获得最佳效果
Gemini 2.5 Flash Image是Google最新、最快、最高效的原生多模态模型。
它的独特之处在于其原生多模态架构,它
从训练开始就能够在同时处理文本和图像
。这使其具备了超越简单图像生成的强大功能,如对话式编辑、多图像合成和图像内容的逻辑推理。
我们可以实现:
•
文本 --> 图像:
根据文字描述生成高质量图像。
•
图像+文本 --> 图像(编辑):
提供图片并使用文字提示添加、删除或修改元素,更改样式或调整颜色。
•
多图像到图像(构图和风格转换):
使用多个输入图像合成新场景,或将风格从一个图像转移到另一个图像。
•
迭代完善:
在多轮对话中逐步完善图像,并做出微小调整。
•
文本渲染:
生成包含清晰、布局合理的文本的图像,比如LOGO、图表和海报等等。
本指南将教您如何编写提示和提供说明,以便从Gemini 2.5 Flash中获得更好的结果。
一个基本原则!!
“
描述场景,而不仅仅是列出关键词。
该模型的核心优势在于其深度语言理解能力。叙述性的描述段落比简单的不相关词汇列表产生更好、更连贯的图像。
其实就是写场景,纯自然语言描述。
比如:
√ 一个女孩站在沙滩上看向男孩,远方的夕阳逐渐落下,天空中偶尔有几只海鸥飞过。
× 女孩,沙滩,男孩,夕阳落下,海鸥飞过
🌹文生图场景
1. 写实类场景图
要想获得写实场景,就要像摄影师一样思考。提及相机角度、镜头类型、光线和细节,将引导模型获得逼真的效果。