Gemini 可以直接在聊天中生成图片:你写下“生成一张……的图片”,几秒钟内就能收到图片,然后通过对话继续调整(“改成夜景”、“去掉背景里的车”)。默认引擎是 Nano Banana 2,免费但限额不固定;追求最高画质可以用 Nano Banana Pro。在意大利可以正常使用。
我几乎每天都用 Gemini 生成图片,当我需要快速出图、不想打开十个标签页时,它已经成为我的首选工具。在这篇指南里,我会完整演示怎么做,网页端和移动端都讲,包括我自己用的提示词公式、如何编辑上传的图片、到底免费到什么程度,以及把生成图用于工作前需要了解的版权和水印问题。文中所有数据均在 2026 年 7 月核实过:我特意说明这一点,是因为这些工具每个月都在变,而免费额度的数字是所有信息里最不稳定的。
如果你从零开始,这篇文章是更完整的免费 AI 生成图片指南的一部分,在那里我把 Gemini 和我测试过的另外六款工具做了对比。
Gemini 是如何生成图片的
Gemini 并不是“调用”一个外部程序来画图。生成是原生且多模态的:和你聊天的同一个模型理解文字、生成图片,并在同一段对话中修改它。这正是整个流程如此自然的原因,因为你永远不需要在应用之间切换。
直到 2025 年年中,幕后运行的还是 Imagen。现在不是了。引擎换成了昵称叫“Nano Banana”的模型家族,也就是 Gemini 的原生图片生成模型。先把名字理清楚,因为这是所有人都会混淆的地方:
- Nano Banana 2(Gemini 3.1 Flash Image):免费应用中的默认模型。速度快,非常适合日常使用,免费版下载分辨率为 1K。
- Nano Banana Pro(Gemini 3 Pro Image):顶级模型。分辨率最高 4K,文字清晰,通过 Search 获取世界知识,最多五个人物的一致性,还能融合多张图片。但在免费套餐中限制很严。
- Imagen:Google DeepMind 老的专用文生图家族。正在退役(Imagen 3 已经关停,Imagen 4 将于 2026 年 8 月 17 日在 Gemini API 上关闭),已不再是 Gemini 应用背后的引擎。如果你想知道它能做什么、为什么退场,我在 Google 的 Imagen 一文中有介绍。
实际使用中:你打开 Gemini 要一张图,用的就是 Nano Banana 2。想要最佳效果就切换到 Nano Banana Pro。Imagen 已经出局。想彻底搞懂底层模型、价格和进阶用法,我写了一篇专门的指南:Nano Banana Pro:价格与使用方法。
用 Gemini 生成图片的分步教程(网页端和移动端)
最好的一点是,你不需要学任何语法。下面是我遵循的完整流程。
网页端(gemini.google.com):
- 打开 gemini.google.com,用你的 Google 账号登录(需要完成年龄验证,稍后细说)。
- 在底部的输入栏用自然语言写下你的需求:“生成一张……的图片”、“画一幅……的插画”、“绘制……”。也可以打开工具菜单,选择创建图片(带香蕉图标的那个)。
- 发送。图片通常在十到二十秒内生成。
- 通过对话迭代。 不需要第一次就写出完美提示词:在聊天里回复“改成夜景”、“前景加一只狗”、“水彩风格”、“竖版”。Gemini 会保留上下文重新生成。
- 满意之后,按原始尺寸下载图片(免费版 1K,付费套餐 2K)。
移动端(Android 和 iOS 的 Gemini 应用):
流程完全一样。打开应用,输入需求或点击创建图片按钮,在对话中迭代,然后点按下载或分享。方便的是,你还可以用语音口述提示词,并从相册上传照片进行编辑。
我很欣赏的一个细节:对话式迭代是 Gemini 真正的超能力。用其他工具时每次尝试都要从头再来,而这里你是在前一次结果上继续搭建,就像在指导一位摄影师。
高效提示词的公式
模糊的提示词只会得到模糊的结果。当我想一次就拿到精准的画面时,会用六个模块来搭建提示词。不必全部使用,也不必按这个顺序,但记住它们可以避免那种“一眼 AI”的平庸图片。
主体 + 动作 + 场景 + 风格 + 光线/构图 + 画幅比例
一个可以直接照抄的具体例子:
- 主体: 一位系着亚麻围裙的咖啡师
- 动作: 正在倒一杯带树叶拉花的卡布奇诺
- 场景: 苏黎世一家极简风格的咖啡馆,清晨
- 风格: 杂志风摄影,暖色调
- 光线/构图: 侧窗透入的柔和自然光,近景特写
- 画幅比例: 竖版 9:16
连起来就是一句话:“生成一张图片:一位系着亚麻围裙的咖啡师正在倒一杯带树叶拉花的卡布奇诺,场景是苏黎世一家极简风格的咖啡馆,清晨,杂志风摄影,暖色调,侧窗透入的柔和自然光,近景特写,竖版 9:16。”比例就是直接写在提示词里设定的:没有专门的菜单,直接要求“方形”、“横版 16:9”、“竖版”即可。
我的实用建议:从简单的开始,看看返回什么,然后在对话中修正。这比盲目写一长串提示词快得多。
编辑你上传的图片
到这里,Gemini 不再只是生成器,而是变成了编辑器。你上传一张自己的照片(或之前生成的图片),然后用文字来修改它。我最常做的几件事:
- 移除物体或人物: “去掉右边的招牌”、“移除背景里的人”。
- 更换或去除背景: “换成白色摄影棚背景”、“把背景换成日落时分的海滩”。
- 改变光线和氛围: “让光线更暖、更金色”、“把场景变成夜晚”。
- 风格迁移: “改成水彩风格”、“给它一种五十年代插画的质感”。
- 上色和修饰: 给黑白照片上色、改变衣服颜色、修正小细节。
全程不需要修图软件。对社交媒体工作来说,这是一次换挡:以前需要 Photoshop 的修饰,现在一句话就能完成。
人物和品牌的一致性
AI 生成工具的老问题之一,是同一个人物每张图都换脸。Nano Banana Pro 在这方面进步很大:最多可以保持五个不同人物的一致性,还能把最多十四张参考图融合到一个场景里。实际使用中,你可以在一系列视觉素材中保持同一张脸、同一个产品或同一套品牌配色,这对搭建广告系列或轮播图至关重要。
我的方法是:先生成或上传主体的参考图,然后要求生成“同一个人”或“同一个产品”的新场景,只描述变化的部分。最佳一致性来自 Pro 模型,所以对于认真的品牌视觉项目,升级到付费套餐是值得的。
图片里的文字
在图片中写出可读的文字一直是 AI 的软肋。Gemini,尤其是 Nano Banana Pro,已经能很好地处理清晰的多语言文字:海报、带一句话的帖子、印有产品名的包装样机。长段文字还不算万无一失,但对于标题、口号或海报上的品牌名,结果往往可以直接使用。不过我还是建议每次都要校对:长文本仍可能写错个别字符。
分辨率、下载和画幅比例
下载时,图片按模型的原始尺寸输出。免费套餐是 1K。付费套餐解锁 2K,Nano Banana Pro 最高可达 4K(例如 5632x3072 像素),需要印刷或制作大幅面素材时很有用。画幅比例如前所述,直接在提示词里说明。如果同一张图需要多种比例,让 Gemini 按新的宽高比重新生成,而不是手动裁剪。
套餐和限额:到底免费到什么程度
这部分我必须跟你说实话:免费套餐的每日限额是所有数据里波动最大的。Google 不公布稳定的官方数字,而且数值会随时间变化。下面的数字仅供参考,于 2026 年 7 月核实,不要当成保证值。
| 套餐 | 每日图片数量(参考值) | 模型与分辨率 |
|---|---|---|
| 免费版 | Nano Banana 2:不固定,大致每天几十张。Nano Banana Pro:缩减至约每天 2 张 | 默认 Nano Banana 2,下载 1K |
| Google AI Pro(意大利价格待核实) | 约每天 100 张 | Nano Banana Pro,最高 2K/4K |
| Google AI Ultra | 高得多(各来源数字不一) | 最高分辨率 + Flow 视频工具 |
一个重要的细节:2025 年 12 月,Nano Banana Pro 的免费限额被缩减到大约每天两张。所以如果你需要持续使用顶级模型,免费套餐是不够的。关于 Google AI Pro 和 Ultra 的欧元价格:请务必查看官方页面,因为价格因国家和时间而异,我不想给你一个一个月后就过时的数字。
SynthID:隐形水印
每张用 Gemini 生成的图片都带有 SynthID,Google DeepMind 的水印系统。这是一个嵌入像素中的隐形标记,外加(在免费版和 Pro 上)一个可见标识。它的作用是标明图片由 AI 生成。
还有 SynthID Detector:你上传一张图片,它会告诉你图片是否含有水印,也就是是否可能由 AI 生成。这是一个有助于透明度的工具,而且正变得越来越重要。记住一个实用要点:移除或篡改 SynthID 违反 Google 的服务条款。
意大利和欧盟的商用与版权问题
必要的声明:本文不构成法律意见,对于重要的客户项目,建议请专业人士核实条款。在此前提下,以下是我在 2026 年 7 月理解的情况。
根据 Gemini 应用的条款,你生成的结果归你所有,通常允许商用,但不具排他性。不过有几个“但是”你需要知道:
- 第三方素材: 如果结果中出现受保护的元素(商标、知名角色、他人作品),它们仍然受保护。是 AI 生成的并不意味着你拥有权利。
- SynthID: 去除水印违反条款。
- 免费版的数据隐私: 在免费套餐中,你的提示词可能被用于训练。对于重视保密性的客户工作,建议考虑付费套餐。
- 欧盟版权: 纯 AI 生成、没有实质性人类创作贡献的作品,其地位在欧洲仍不明确。不要想当然地认为自己可以主张完整版权。
我的实用原则:做一般的社媒和营销内容,Gemini 完全够用。对于需要强权利和保密性的素材,提高一个等级(付费套餐),并记录好你的创作贡献。
为什么 Gemini 不给你生成图片(故障排查)
如果你写了提示词却毫无反应,绝大多数情况下原因只有一个:你的 Google 账号的年龄验证。图片生成要求账号完成年龄验证,在此之前该功能保持锁定。
按顺序这样做:
- 在 Google 账号设置中完成年龄验证。
- 等待。 验证后最长可能需要 24 小时功能才会启用。这是正常的,不是 bug。
- 关于年龄要求,官方来源的说法并不完全一致(有些标明生成的最低年龄门槛,编辑图片的门槛更高)。我不敢给你一个死数字:请查看 Google 最新的支持页面,确认适用于你情况的要求。
- 如果年龄没问题,再排查其他原因:提示词可能违反政策(换个表述)、可能已达每日限额(稍后重试),或者服务暂时过载。
Gemini 在意大利可用吗?
可用。Gemini 的图片生成功能在意大利开放,包括包含人物的图片。欧洲过去封锁人脸的限制已经解除。你只需要一个完成年龄验证的 Google 账号。这是一个新近且积极的变化:就在不久前,欧盟还限制生成人物。
总结
Gemini 是目前你可以免费使用、最顺手的 AI 图片生成工具:你说话,它画图,你在对话中修正。Nano Banana 2 覆盖日常需求,Nano Banana Pro 在需要画质、文字和品牌一致性时拉高标准。记住三个真正重要的点:免费限额不固定、每张图片都带 SynthID 水印、商用前最好先读完条款再交付给客户。
想为你的品牌做出这样的图片吗?
想认真学会为你的品牌使用这些工具,建立一套经得起时间考验、不会在版权和限额上绊倒你的工作流程吗?我每天都在用它们工作,从品牌视觉到 AI 广告片。了解我的服务,或从这里联系我。
发表评论
评论会经过审核后才会公开显示。