写在前面
nano banana(gemini-3-pro-image-preview)的特别能力:
- 拥有gemini3 pro级别的推理和视觉识别能力,包括代码。以至于可以进行视觉编程
- 具有联网补充信息的能力
- 在gemini中使用时,他会给你预览1k的小图(看到的文字可能模糊,当你下载可以下载4k大图,文字就不会模糊了。猜测机制是在此图的基础上进行放大算法,并非重新生成)
- 超强的控制能力和原图保持能力
- API调用可以有更大的自由度:出图清晰度可选:1k\2k\4k,可以生成无水印的图片。
- (猜测) 文字排版的时候,他会有个类似于ppt的文字工具一样,先把文字输入在那(多次发现nano输出的文字,会超出正常范围,很像文字工具的状态)
- (猜测) nano banana 不是单纯的生图模型,而是一个multi-agent-system。上一条说的文字工具就是其中一个,tools
- (猜测) 在nano banana出世之前,在notebookllm就已经有了类似风格的生成功能(视频生成),分镜的效果就很像PPT。

缺点:
- 可控性超强,意味着提示词书写难度很大,想要比较美观的艺术海报效果,需要你写的非常清楚。这个方向,上手难度较大。
- 简单的提示词,任然会导致出现一些逻辑错误,需要仔细辨别
实战场景
一、没提前想好构型的图,不需要复杂的方法,就能有比较好的效果。
应用场景包括且不限于:github项目的文档说明、视频总结、笔记总结
【提示词(直接加在你的文章最后面)】 :
根据以上内容,生成一图胜千言的图片:
要求:信息图表风格,逻辑清晰,数据可视化,扁平化设计,专业,适合知识分享,使用中文。
图示为主,仅需配比少量文字,请直接生成图片:
- 案例1
补充说明:第一次出图并没有达到我想要的效果,直接用语言指导它修改,这个案例我只用了一次修改:我希望说明的是这个multi-agent系统是如何配合的,表现每个agent和tool参与了什么,直接出图。

- 案例2

二、开发软件之前的UI交互草稿
当做一个软件的demo,有一张图片作为参考,可以更加高效精准。
当你构思好一个交互和效果的时候,往往直接生成代码不能生成你想要的效果,可以先用生图的方法,快速的实现复杂的UI效果,不然调代码成本更高。
直接用语言描述即可,有什么想法直接说,需要修改哪里可以直接言出法随
【特别的经验】nano banana的修图功能很强,当你不需要在上一张图的基础上修改时,可以在提示词中强调:重新绘制!


三、生成艺术海报
前文就提到nano banana具有超强的控制力,当你能够精准的描述画面的元素和呈现形式,以及元素之间的关系,你就能制作出超级炫酷的海报。
以下是我制作的健身打卡海报图,可以自由替换训练内容,并且每次都会有可控的变化,有抽卡的乐趣:

【特别的经验】
- 复杂的海报意味着超长的提示词,想要调整其中数据的变化,且保持风格的稳定,可以直接将画面描述改成伪代码的形式。
- nano banan的基本审美还有些欠缺,制作这样的海报需要一些基本的平面设计的基础,了解画面构成,才会有比较好的效果
- 简单的方法,可以直接去上网找参考图,然后通过多轮的对话,适当的让gemini帮你科普相关平面设计原理。
【上述打卡海报提示词生成工具】
我已经制作成了简单的网页工具(gemini白板功能制作),固化了一部分的伪代码,随意输入今天的训练日志,就能生成高质量的提示词。
MORE
其他方向的实验:

更多案例网站分享(友情链接)
已更新 800+ Nanobanana Pro 提示词,持续更新中...
挖坑
- 之前测试nanobana的极限,做了几个实验设计,未来等有时间了把实验内容总结出来,和大家分享
- 上文中提到的健身APP已经完善了MAS框架和前端交互框架搭建、数据协议文档、数据流转设计文档、前端优化文档...未来将完整开源项目,如果效果不错,将并且分享整个vibe coding 过程、经验、感悟…