谷歌发布 Nano Banana 2.1,图像生成与对话修图再升级
Google DeepMind 于 10 月 7 日正式发布高效率图像生成与对话式编辑模型 Nano Banana 2.1,作为稳定版本接入 Gemini App、AI Studio 与 API,在视觉质量、文字渲染与多图一致性上明显升级。
10 月 7 日,Google DeepMind 正式发布图像生成与对话式编辑模型 Nano Banana 2.1(模型代号 Gemini-nano-banana-2.1),并已作为稳定版本接入 Gemini App、Google AI Studio、Gemini API 与 Google Search AI Mode 等平台。这是今年 2 月 Nano Banana 2.0 之后的又一次迭代,定位为兼顾 Flash 级速度和高性价比的高效率图像模型。

新版在多个维度做了针对性改进。视觉质量与真实感在 1K、2K、4K 输出分辨率下均有提升,默认输出为 1K;谷歌还修复了宽幅与全景比例(1:4、4:1、1:8、8:1)在 2K 和 4K 下的平铺伪影。文字渲染与信息图版式准确度同步增强,对需要图中排版的场景更友好。
多图融合是本次更新的重点之一:模型现在最多可接收 14 张参考图,支持最多 4 个角色的形象一致性,以及最多 10 个物体的细节保真,让反复修改同一素材、保持人物与道具不变成为可行的生产流程。它还新增对 Google 网页与图片搜索的 grounding 能力,并允许在 minimal、medium(默认)、high 三档思考强度间切换。
技术底座上,Nano Banana 2.1 属于 Gemini 3 系列,底层基于 Gemini 3.6 Flash,可理解文本、图像、视频与 PDF 输入并生成图像与文本,输入上下文窗口达 13.1 万 token。谷歌将其定位为 Nano Banana Pro(Gemini 3 Pro Image)更高效的同门版本,明确把方向从生成一张好看的图推向可反复编辑、保持一致的视觉生产工具,进一步向专业设计师与工作流靠拢。
读者评论 (0)
想参与讨论?请 登录 后发表评论。
还没有评论,欢迎抢沙发!