谷歌发布Nano Banana 2.1,旧版月底停用

Google DeepMind 10 月 6 日发布图像模型 Nano Banana 2.1,同日在 Gemini API 里转为正式可用,模型 ID 是 gemini-nano-banana-2.1。它是 Nano Banana 2(接口名 gemini-3.1-flash-image)的更新版,旧接口将在 10 月 29 日停用。

按官方模型卡,Nano Banana 2.1 属于 Gemini 3 系列,底座是 Gemini 3.6 Flash,本身是一个原生多模态的推理模型。输入支持文本和图片,上下文窗口最高 100 万 token;输出可以是图片,也可以是最长 6.4 万 token 的文字。

改了哪些地方

API 更新日志列出的改进有四项:画面质量、提示词遵循、多轮对话里的角色一致性、文字渲染。新增的是超宽画幅,支持 1:4、4:1、1:8、8:1 四种比例,分辨率可选 1K、2K、4K。官方说速度和成本仍维持在 Flash 档。

模型卡给了两组对比数字:

  • 文生图整体人类偏好评分,Nano Banana 2.1 的 Thinking 版为 1050(±14),Nano Banana 2 是 990(±7);
  • 信息图的事实准确率从 0.179 提到 0.521。

后一项涨幅接近三倍。信息图要求模型既画得对,数字和标注也得对,过去生图模型在这里最容易出错。0.521 仍然意味着差不多一半的信息图有事实问题,用来做正式材料还得人工核一遍。

官方自己写的短板

模型卡列了几条已知局限:小字号和长段落的文字渲染效果差;输入和输出之间的角色一致性不能保证;空间定位推理有限,左右这类方位偶尔会搞混。知识截止时间方面,部分领域到 2026 年 3 月,另一些领域只到 2025 年 1 月。

安全部分,模型卡称它通过了儿童安全的上线门槛,专项红队没有发现严重问题,前沿安全评估里没有触及任何需跟踪或关键的能力等级。

上了哪些地方

除了 Gemini App、Google AI Studio 和 Gemini API,Nano Banana 2.1 同时接进了搜索的 AI Mode、Google Ads、视频工具 Flow 和设计工具 Stitch。广告和搜索两个入口说明,谷歌打算把它直接用在商业素材的批量生成上。

对国内开发者

Gemini API 在中国大陆不能直连,国内团队多数通过海外云或第三方聚合平台调用。旧接口 23 天后关停,聚合平台那边的模型映射能不能及时切过去,是最容易出问题的一环;用 gemini-3.1-flash-image 跑生产任务的团队,最好这周就在测试环境换上新 ID。

中文场景还有一处要留意。模型卡把“小字号文字渲染差”写进了局限,而中文字形笔画密,同样字号下比英文更容易糊,做海报和电商主图时,大标题问题不大,小字说明可能仍要后期补。谷歌目前没有单独公布中文渲染的评测数据。

更新日志也没有写新模型的价格,是否沿用 Nano Banana 2 的计费标准,官方还没说明。

参考来源:CocoLoop、Google DeepMind 模型卡、Gemini API 更新日志;偏好评分与信息图准确率以模型卡公布的评测结果为准,停用安排以 Gemini API 更新日志为准。