跳到正文
首页文章Nano Banana 2 单张比我们好,一组就不行

Nano Banana 2 单张比我们好,一组就不行

Nano Banana Pro 和 2 于 5 月 28 日在 Google Cloud 上正式可用。我拿五个左右 3C 商品,让它和我们的 SD 1.5 加 LoRA 各出一轮,设计同事盲审。单看一张,它的光影明显更好;一组放在一起,纹理和图案对不上。要不要接的讨论是我发起的,大家最在意的却是成本。

商品图Nano BananaSD 1.5
Nano Banana 2 单张比我们好,一组就不行 封面图

5 月 28 日,Nano Banana Pro 和 Nano Banana 2 在 Google Cloud 上正式可用。这不是两款模型第一次发布:Pro 是 2025 年 11 月 20 日发布的,2 是 2026 年 2 月 26 日发布的。看到这次开放的消息,我想起自己拿它和 Smart Photo 做的那轮比较。

怎么比的

拿的是 3C 商品,五个左右,让它和我们的 SD 1.5 加品类 LoRA 各出一轮。每个商品出四五张,这是商品页上一组图的数量:主图,加几张不同角度和场景的。

看图的是设计同事,盲审。两边的图混在一起,不告诉哪张是谁出的,按 Smart Photo 一直用的标准来判:单张能不能直接上架。另外我自己再加一层,一组看,放在同一个商品页上合不合适。

盲审是 Smart Photo 做可用率时就定下的办法。人一旦知道哪张是新模型出的,眼睛就会不自觉地偏,要么偏向新的,要么偏向熟的。

单张,它的光影更好

单张看,它好,而且好得很明显,主要在光影。

光打在外壳上的过渡是自然的,高光的位置和场景里的光源对得上,阴影的软硬也对。盲审挑出来的好图里,它的占了多数。

我们自己那套跑了两年多,可用率八成左右,但单张的上限比它低。我们的图是能用,它的图是像拍出来的。这一点我认。

我们的基座是 SD 1.5,三年多前的模型,光影一直不是它的强项。我们靠模板把场景收在一个范围里,让光别出大错,而不是让光出彩。

一组,纹理和图案对不上

一组看,它就不行了。

同一个商品出四五张,放在一起,商品表面的纹理和图案对不上。有的细一点,有的粗一点;有图案的地方,位置和形状每张略有不同。单看每张都没问题,排在一个商品页上,往下一滑就能看出来:这几张好像不是同一件东西。

一开始我以为是提示词没写好,试了几种写法,把商品描述写得更细,好一点,还是对不上。后来想明白了:它是通用模型,每次生成都在重新理解这件商品。我们的 LoRA 是拿几百张真实商品图训出来的,它认识这类东西,出几张都是同一件。

一组对不上,为什么是大问题

单看这件事,好像只是几张图有点细微差别。放到商品页上,它是一个大问题。

商品页上的几张图,是在一起回答同一个问题:这件东西到底长什么样。主图给个整体,其他几张给角度、给细节、给使用场景。买家往下翻,是在一张张确认。如果几张图里商品表面的纹理和图案不一样,买家确认到的,是一件说不清楚的东西。

说不清楚的后果,轻的是犹豫不买,重的是买了收到货发现和某一张不一样,退回来。对跨境卖家来说,退货的成本比一张图的成本高得多。

两个指标

所以单张好,和一组对,在我们这里是两个指标。

以前只看可用率,是因为一直在和单张的问题斗争。单张能不能用都成问题的时候,没人顾得上一组。现在单张有人做得比我们好了,一组对不对,反而成了我们的长处。

这个长处能保多久,我不知道。通用模型哪天加上多图参考、锁住商品的能力,也许就追上了。

讨论是我发起的,大家最在意成本

比完以后,我在内部发起了一次讨论:要不要把它接进来。

我原本想讨论的是效果。单张好、一组不齐,能不能分开用:主图用它,一组图用我们自己的。可讨论下来,大家最在意的是成本。

这一点我一开始没往那边想,后来想想是对的。Smart Photo 选自建,一个很重要的理由就是成本:用自己的服务器,量上来以后越用越便宜,每月几万张图,单张算下来很低。外部模型是按次付费的,单张看不贵,放到我们的量上,就是一笔持续的、跟着用量往上涨的支出。

效果好一截,值不值这笔钱,要看好在哪。它好在单张的光影,而商品页上真正决定能不能上架的,是一组图是不是同一件商品。为了单张的光影,付一笔按量涨的钱,这笔账在讨论里没算过来。

先放在参考那一栏

讨论到现在没有结论。它先放在参考那一栏:做单张海报、做活动主视觉这类只要一张图的时候,可以试;商品页那一组,还是我们自己的。

外部模型每隔几个月就更新一次,这种比较以后大概会成为常事。这一次我是先比效果、再谈成本,结果效果比完了,讨论却卡在成本上。下一次再比,我会一开始就把成本放进那张表里,和盲审结果放在一起看。

问问 KANG AI

想了解我什么?