找回密码
立即注册
搜索
发回帖 发新帖

6202

积分

0

好友

780

主题
发表于 17 小时前 | 查看: 4| 回复: 0

谷歌刚刚发布了 Nano Banana 2.1,一款基于 Gemini 3.6 Flash 的图像生成与编辑模型。它以一个 Flash 级小模型的姿态,把自家旗舰 Nano Banana Pro 都超了。

Google 官宣 Nano Banana 2.1 发布

划一波重点:

  • 改图:支持蒙版局部编辑,圈哪改哪,其他区域保持原样
  • 一致性:人物、产品连续多轮编辑不变脸,最多可塞 14 张参考图
  • 画质:画面更像实拍,最高支持 4K 直出
  • 价格:出图价是 Nano Banana 2 的一半,1K 一张 0.034 美元
  • 榜单:Arena 多图编辑排第 4,前面只剩 OpenAI 三款 GPT Image
  • 上线:Gemini App、搜索 AI 模式、AI Studio、Flow 等今天起陆续可用

Nano Banana 2.1 生成效果演示

Flash 打赢 Pro,Nano Banana 主打性价比?

Nano Banana 2.1 属于 Gemini 3 系列,基于 Gemini 3.6 Flash,知识截止日期为 2026 年 3 月。

Model dependencies:Nano Banana 2.1 基于 Gemini 3.6 Flash

按照以往的命名方式,Nano Banana 2.1 也可以叫 Gemini 3.6 Flash Image。

官方基准测试显示,Nano Banana 2.1 在视觉设计、编辑、一致性等方面遥遥领先。

文生图能力基准测试对比表

文生图基准数据表

图像编辑能力基准测试表

虽然在小文本渲染、3D 推理和事实性等方面仍有改进空间,但对于需要图片生成和编辑服务的用户来说,这次更新相当出色:

  • 以专业级精度创建与编辑图像,支持多次快速迭代
  • 为海报和复杂图表生成清晰的文字
  • 长上下文的现实世界知识
  • 跨多种语言的本地化文字渲染

网友盲投结果也印证了这一点。

Arena.ai 公布 Nano Banana 2.1 竞技场成绩

在 Arena 竞技场上,Nano Banana 2.1 拿到多图编辑第 4、文生图第 5、单图编辑第 6。多图编辑榜上,排在它前面的只剩 OpenAI 的三款 GPT Image。作为对比,上一代 Nano Banana 2 在这三个榜上分别是第 7、第 11、第 14。

Multi-Image Edit Arena 排行榜

Text-to-Image Arena 排行榜

Image Edit Arena 排行榜

考虑到出图价只有 Nano Banana 2 的一半,谷歌这波显然是要打价格战。

Nano Banana 2.1 生成海报展示

圈哪改哪,脸都不带变的

蒙版编辑用过 PS 的都熟。圈出一块就只改这一块,别的地方原样保留。

但把这个能力放进 AI 生图,一直很难。你跟模型说「把左下角那个杯子换成红的」,它得先猜你说的是哪个杯子,再把整张图重新生成一遍,其他区域能不能保住全凭运气。

现在圈一下就行。换衣服、换招牌、P 掉背景里的路人,都只动圈住的那块。

网友 ibexdream 给它连出三道题:生成、改图、换风格。

ibexdream 的三步测试:提示词遵循、图像编辑、风格转换

第一题画一张纸币:一位托腮沉思的老哲人,头发往后化成一座迷宫。

Nano Banana 2.1 生成的哲学主题纸币插画

第二题在这张图上改:编号从「№ 1098471」换成「NB-21098471」,两侧小字也换了,老哲人手里多了根香蕉当电话,底部加了条「IN BANANA WE TRUST」的飘带。两张放在一起看,迷宫、长袍、胡子都原样没动。

第三题换风格,整张纸币变成一幅油画。

Nano Banana 2.1 风格转换:从版画风到油画

在模型卡评分里,蒙版编辑这一项 2.1 拿了 1049 分,比 Nano Banana 2 高 84 分,比 Pro 高 122 分。即便不开思考模式,2.1 在每一项上也都压着 Pro。

图像编辑各项能力得分对比表

另一项升级是主体一致性,说白了就是别变脸。

拍电商图、做品牌海报、画连载漫画的人应该深有体会:同一个模特换十套衣服,换到第三套脸就开始不对劲了。

这次涨分最猛的就是这一项。多人物一致性拿到 1106 分,比 Nano Banana 2 高出 128 分。开发者最多能塞 10 张物体参考图、4 张人物参考图进去。

网友 BG-VC 就这么试了:一张模特照,加上上衣、半裙、包、鞋、耳环五件单品参考图,让它出六个不同场景的照片,六张一次生成。

BG-VC 测试 Nano Banana 2.1 一致性的推文

Nano Banana 2.1 生成的模特与单品一致性测试图

走着、坐着、靠在台边,六个姿势下来,脸、衣服、包和耳环都没走样,拿来当一组电商图都够了。

画面本身也更像实拍。官方样图里,挂满水珠的甲虫、粉房子外楼梯上的绿裙姑娘,乍一看真分不出是 AI 画的。

Nano Banana 2.1 官方样图:微距甲虫与复古建筑场景

另外,做信息图时它能先上谷歌网页搜索和图片搜索查资料再动笔。谷歌自动评测里,2.1 做信息图的事实准确分是 0.521,Nano Banana 2 只有 0.179,Pro 也才 0.265。也就是说,让它画科普图,画错内容的情况会少很多。

信息图事实性基准测试对比表

画图便宜了,动脑贵了

出图按每百万 token 30 美元收费,正好是 Nano Banana 2 的一半。1K 一张从 0.067 美元降到 0.034 美元,4K 从 0.151 美元降到 0.076 美元。这个价格跟 7 月主打白菜价的 Nano Banana 2 Lite 一模一样。

不过其他项反倒涨了。输入从每百万 token 0.5 美元涨到 1.5 美元,是原来的 3 倍;文字和思考输出也从 3 美元涨到 7.5 美元。相当于谷歌把钱从「画」挪到了「想」上。

TestingCatalog 公布的 Nano Banana 2.1 定价细节

Google AI Studio 中的模型选择界面

开发者现在就能在 AI Studio 里选到它,模型名叫 gemini-nano-banana-2.1。之前的 Nano Banana 2 的 API 会在 10 月 29 日关停。

普通用户也不用等。Gemini App、搜索的 AI 模式、Flow、设计工具 Stitch、Google Ads 和 Gemini 企业平台,今天起陆续上线。在谷歌 App 里点搜索框下面那个香蕉图标就能玩。

Gemini App 中图像生成界面

网友连夜上强度,GPT 也被拉来对线

模型上线不到一小时,X 上就有人开测了。

Mark Kretschmann 给它出了一道「酷刑测试」:一张图里同时塞进人群、杂物、能看清的文字、雨天的反光,再看这些东西凑在一起还像不像一张真照片。

Mark Kretschmann 对 Nano Banana 2.1 的酷刑测试

Nano Banana 2.1 生成的雨天咖啡店场景

Luis Catacora 让它画一块茶馆菜单板,同一款「茉莉绿茶」要用英语、日语、阿拉伯语、印地语四种文字一次出图。

Luis Catacora 测试多语言菜单板

Nano Banana 2.1 生成的多语言菜单板

Lad 写了一段专挑 AI 软肋的提示词:细线纹身、3 条项链、一排耳饰、手链,再加一副能透出眼睛的有色墨镜,分别交给 Nano Banana 2.1 和 GPT Image 2.5 各画一张来比。

Lad 对比 Nano Banana 2.1 和 GPT Image 2.5

左边是 Nano Banana 2.1,右边是 GPT Image 2.5。Nano Banana 2.1 把纹身全画在了指定位置,项链、耳饰、手链也都在,就是墨镜忘了上色,脸还被晒红了一片。

Nano Banana 2.1 与 GPT Image 2.5 生成效果对比

Pankaj Kumar 找的对手是 GPT Image 2。两个模型画同一个场景:书桌上的一块手表。

Pankaj Kumar 对比 Nano Banana 2.1 与 GPT Image 2

左边是 Nano Banana 2.1 画的,自然光,像随手拍的;右边是 GPT Image 2 画的,开了台灯,表盘还换成了镂空机芯,一股精修广告图的味道。

Nano Banana 2.1 与 GPT Image 2 手表场景对比

速度上差得更多。API 平台 AI/ML API 准备了 5 个提示词,每个都让 Nano Banana 2.1 和 GPT Images 2.5 各画一张。Nano Banana 2.1 出一张图要 11 秒、0.044 美元,GPT Images 2.5 要 50 秒、0.069 美元。

AshutoshShrivastava 分享 Nano Banana 2.1 与 GPT Images 对比

Nano Banana 2.1 与 GPT Images 2.5 多场景生成对比

Hugo Plat 出了 4 道太空题:旋涡星系、超大质量黑洞、类星体,外加把整个太阳系装进一张图。4 张画下来,Nano Banana 2.1 一共花 0.178 美元,GPT Image 2.5 要 0.284 美元。

Hugo Plat 的太空主题对比测试

同一道黑洞题,左边的 Nano Banana 2.1 画得克制,右边的 GPT Image 2.5 把星云和火焰全拉满了。

Nano Banana 2.1 与 GPT Image 2.5 黑洞生成对比

中文这块,知名博主歸藏测了一圈,结论是字更清楚、错字少了很多,排版也干净,没有 GPT 那种破碎感。他还觉得,比起 GPT,它最大的优势是能直接出 4K。

歸藏分享 Nano Banana 2.1 中文生成体验

Nano Banana 2.1 生成的中文海报:牛油果

Nano Banana 2.1 生成的中文海报:好运连连

Nano Banana 2.1 生成的中文信息图:茶文化

Nano Banana 2.1 生成的中文海报:悦目荷花

当然也不是没有破绽。「传承与新生」旁边那行竖排小英文,放大一看已经糊成了乱码。

Nano Banana 2.1 生成的中文海报局部乱码

生图之战,打到改图了

4 月,GPT Image 2 上线,在同一个 Arena 文生图榜上领先 Nano Banana 2 整整 240 分。9 月,OpenAI 又发了 Images 2.5,主打只改指定区域、多轮修改不跑偏。不到一个月,谷歌的 2.1 也押在了这两件事上。

两家前后脚卷改图,原因不难猜:电商、广告、品牌设计这些行当,一张图动辄改上十几版,改到第十版还不崩,比第一版惊艳重要得多。所以谷歌这次直接把 2.1 塞进了 Google Ads 和企业平台,冲的就是这群天天改图的客户。

话说回来,Flash 都把 Pro 超了,Nano Banana Pro 的下一代,谷歌打算什么时候端上来?

参考资料: https://x.com/googleaistudio/status/2107501303890915550




上一篇:Claude 攻下概率论「圣杯」:AI 证明渗流理论 θ(p_c)=0 猜想
下一篇:Claude中文界面悄然上线,结账页能选中中国,支持地区却无中国大陆
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-10-8 20:29 , Processed in 0.068758 second(s), 41 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表