Gemini AI 照片编辑器
上传照片,写出要改什么,Google Gemini 3 Pro 图像模型会重新渲染整张图。它理解错了的时候,GPT Image 2 就在同一个面板的下拉里。每次编辑 3 积分起。
两个引擎,一次上传
其他排在这个词上的页面都只给你一个引擎,然后告诉你它最好。这一页给你四个——三个 Google Gemini 编辑模型加上 OpenAI 的 GPT Image 2——共用同一个上传框,因为它们翻车的地方不一样,而你通常是在积分花完之后才发现是哪一个。默认是 Gemini 3 Pro:每次 10 积分,最多可传 14 张参考图。
这一次改图,该用 Gemini 还是 GPT Image 2?
两个引擎都在上方的下拉里。下面是把同一批指令分别喂给它们之后,实事求是的分工。
Gemini 3 Pro
在保住人脸、手部和画面里原有招牌文字这件事上,它比列表里其他任何一个都稳,而且最多接收 14 张参考图——主体、风格参考、背景可以一次性交给它。它也会逐字执行长指令:你告诉它哪里别动,它就真的不动。
画面里有人、有需要看清的文字,或者有必须原样保留的东西时,用它。
GPT Image 2
对写得松散、没说全的提示词更愿意自己补全,而且它的质量与分辨率档位让同一次编辑的成本可以在 2 到 108 积分之间浮动。Gemini 要你说清楚,GPT Image 2 则替你填空——有时正合意,有时不。
指令本来就想留白,或者 Gemini 反复理解偏了的时候,用它。
人脸还是那张脸
换衣服、换背景、换时间段,画面里的人依然认得出是同一个人。这决定了多步编辑可不可行——你可以连下三条指令,而不会到第三步时主角已经变成一个陌生人。画面里有人的活,这一点就是选 Gemini 3 Pro 而不是更便宜档位的最主要理由。

一次最多 14 张参考图
大多数编辑器只收一张原图。Gemini 3 Pro 收 14 张,所以一次编辑就能把主体取自一张照片、光线取自第二张、场景取自第三张,而不用一步步串着改、每步掉一点保真度。全部拖进上方的上传框即可。

画面里的文字仍然能读
招牌、包装标签、菜单板,是大多数图像模型化成乱码字形的地方。Gemini 3 Pro 明显更稳,只要画面里本来就有字——店面、产品盒、海报样稿——这一点就很关键。长段落和密集小字仍然是它的失败区。

怎么用 Gemini 改一张照片
上传照片
放入原图,JPG、PNG 或 WebP 都行。如果这次编辑需要主体加参考,Gemini 3 Pro 一次最多可以接收 14 张。
写出要改什么
写成一句指令,而不是标签堆砌。「把灰白的天空换成阴天黄昏,建筑本身的照明保持不变」比「黄昏、氛围感、电影感」有效得多。哪些该变要说,哪些该留也要说。
不对就换引擎
如果结果漏掉了你一半的指令,在下拉里换个模型,把同一句提示词再跑一遍。同样的上传、同样的提示词,不同的理解方式——这个对照正是这一页存在的意义。
下拉里的四个编辑器
这不是厂商跑分,而是这一页真正在跑的引擎,配上本站真正收取的数字。
| 对比项 | Nano Banana Pro | Nano Banana 2 | Nano Banana Edit | GPT Image 2 |
|---|---|---|---|---|
| 引擎 | Gemini 3 Pro Image | Gemini 3.1 Flash Image | Gemini 2.5 Flash Image | GPT Image 2 |
| 开发方 | OpenAI | |||
| 最适合 | 人脸、可读文字、多参考图合成 | 大部分日常编辑,比 Pro 略便宜 | 小幅修图,也是试用本站最便宜的入口 | 提示词写得松,或者 Gemini 反复理解偏时换个思路 |
| 参考图上限 | 14 | 14 | 5 | 5 |
| 可选画幅 | 10 | 10 | 10 | 16 |
| 每次编辑消耗 | 10 积分 | 8 积分 | 3 积分 | 8 积分 |
表中的引擎名称、参考图上限与积分消耗均读取自本站自己的配置。GPT Image 2 按质量与分辨率计费,8 积分是它默认的 medium/1K 档,整体区间为 2 到 108。
大家都在这里改什么
四类反复出现的活,每一类都是一句指令的事,不用在 Photoshop 里耗一下午。

产品图
同一件东西放到大理石台面、亚麻背景、咖啡馆桌面上,不用重拍。产品的外形和标签不变,周围的光重新生成。

人像
换背景、换穿搭,或者救回在糟糕房间里拍出来的光线,同时脸还认得出是本人。

招牌与包装
在空白招牌或素色盒子上写入新字并保持可读,而不是多数编辑器给出的那种糊成一团的伪文字。

竖版裁切
把一张宽幅照片重建成 9:16:主体重新居中,画面缺的边补上,而不是把半张图裁掉。
看看其他 AI 模型
常见问题
它是一个靠指令工作的图像编辑器:上传照片,用一句话描述要改什么,Google Gemini 3 Pro 图像模型就把这个改动应用到画面上重新渲染。没有画笔、蒙版和图层,提示词是唯一的控制方式。
不是。本站是独立站点,与 Google 无从属关系,也未获其背书。真实的是引擎本身:编辑器通过我们的 API 供应商调用 Google Gemini 3 Pro 图像模型,出图来自 Google 的模型,而不是某个仿冒替代品。
默认是 gemini-3-pro-image,也就是 Google 对外称作 Nano Banana Pro 的那个模型。下拉里还有 Gemini 3.1 Flash Image、一个更便宜的 Gemini 编辑模型,以及 OpenAI 的 GPT Image 2——同一次上传和同一句提示词可以在它们之间任意切换重跑。
部分可以。用 Google 登录会赠送 8 积分,够在最便宜的 Gemini 编辑档位上改 2 次(每次 3 积分)。但不够跑一次 Gemini 3 Pro——它要 10 积分。所以如果你就是想试 Pro,需要在赠送额度之外再充值。
Gemini 3 Pro 每次 10 积分,4K 档为 18 积分。更便宜的两个 Gemini 编辑档位分别是 3 和 8 积分。GPT Image 2 随你选的质量与分辨率浮动,从 2 积分到 108 积分不等。
画面里有人脸、有需要看清的文字,或者有必须原样保留的东西,以及你希望长指令被逐字执行时,用 Gemini 3 Pro。提示词故意写得松散,或者 Gemini 反复理解偏时,用 GPT Image 2。两个都在同一个下拉里,所以做这个对照只多花一次生成的钱,而不是再开一份订阅。
通常不会,这正是 Gemini 3 Pro 在编辑上最强的一点。换背景、换穿搭、重打光之后,脸基本能保住。但这不是保证:一条指令里改的东西越多,跑偏的概率越大,所以大改动请拆成几次小编辑分步做。
比多数图像模型好。Gemini 3 Pro 能让原有字迹保持可读,也能在场景里写入少量新文字。长段落和密集小字仍然是它崩掉的地方,所以文字多的结果发布前请先自己核一遍。
Gemini 3 Pro 最多 14 张——足够在一次编辑里同时给它主体、风格参考和背景。更便宜的编辑档位和 GPT Image 2 为 5 张。可以多选、拖拽,或者直接粘贴到上传框里。
Gemini 系列有 10 种:Auto、1:1、3:2、2:3、3:4、4:3、9:16、16:9、1:2、2:1。Auto 保持原片比例;选其他比例时,模型会重新构图,而不是直接裁切。GPT Image 2 提供 16 种。
Gemini 3 Pro 可以,4K 档是 18 积分,而不是 10 积分。更便宜的两个 Gemini 编辑档位达不到这个上限,所以需要印刷尺寸的文件而不是网图时,请选 Pro。
可以,但需遵守本站条款以及 Google 对底层模型的使用政策。你上传的内容的权利由你自己负责——请不要编辑你没有使用许可的照片,涉及可辨识的真人和第三方品牌时也请谨慎。
把改动说出来,图就出来了。
一次上传,一句指令,两个引擎轮着跑。3 积分起。