🚀 模型发布 · Google DeepMind

Google 发布 Nano Banana 2 Lite 与 Gemini Omni Flash,图像生成快至 4 秒、视频编辑进入对话时代

6 月 30 日,Google DeepMind 同步推出两款生成式 AI 模型:Nano Banana 2 Lite 以 4 秒出图、0.034 美元/千张的成本成为最快最经济的图像模型;Gemini Omni Flash 面向开发者开放视频生成与对话式编辑能力,定价 0.10 美元/秒。两款模型已在 Google AI Studio、Gemini API 及企业平台上线。

综合公开信息整理 2026-06-30 全文约 3 分钟读完
#Nano Banana 2 Lite #Gemini Omni Flash #Google DeepMind #生成式 AI
⚡ 4 秒出图 Nano Banana 2 Lite 文本到图像延迟
$0.034/千张 图像生成成本,适合高吞吐量场景
$0.10/秒 Omni Flash 视频生成定价

⚡ 30 秒速览

  • Nano Banana 2 Lite:出图仅需 4 秒,成本 0.034 美元/千张,适合高吞吐量、实时交互场景。
  • Gemini Omni Flash:支持自然语言对话式视频编辑,10 秒生成,定价 0.10 美元/秒,与 Veo 3.1 Fast 持平。
  • 开放平台:两款模型已在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 上线。
  • 升级路径:Nano Banana 2 Lite 可无缝替换旧版 Nano Banana,速度更快、质量更高、成本更低。
  • 模型协同:先由 Lite 生成图像,再由 Omni Flash 动画化为视频,构建端到端多媒体工作流。

01极速图像生成 Nano Banana 2 Lite:4 秒出图,成本降 60%

Nano Banana 2 Lite(gemini-3.1-flash-lite-image)是 Google 图像模型家族中最快、最经济的成员。它专为高吞吐量管线设计,在延迟和成本上做到了极致。

旧版 Nano Banana(gemini-2.5-flash-image)

出图延迟约 8-10 秒,成本约 0.08 美元/千张。适合一般场景,但速度与成本已非最优。

Nano Banana 2 Lite

出图延迟压缩至 4 秒,成本降至 0.034 美元/千张。提示遵从性、角色一致性和文字渲染能力均优于旧版。

4文本到图像延迟
$0.034每千张成本
⬇ 60%成本降幅
⬇ 50%延迟降幅

注:延迟数据基于标准文本到图像任务,成本按 1K 分辨率图像计算。实际表现可能因提示复杂度略有浮动。

除了速度和成本,Nano Banana 2 Lite 在提示遵从性、角色一致性、图像内文字渲染三个维度上均保持了可靠水准。Google 推荐所有使用旧版 Nano Banana 的开发者直接升级,无需修改代码即可获得性能提升。

但速度只是故事的一半。另一款模型瞄准的是视频生成——一个更复杂的战场。

02视频生成新范式 Gemini Omni Flash:对话式编辑,0.10 美元/秒

Gemini Omni Flash(gemini-omni-flash-preview)是 Google 首款面向开发者开放的多模态视频生成模型。它在此前 I/O 大会上亮相,今天正式通过 Gemini API 和 Google AI Studio 提供。

与传统的视频生成工具不同,Omni Flash 的核心能力是对话式编辑——用自然语言对视频进行多轮修改,模型会理解上下文并保持风格一致。

🗣️ 对话式编辑 🖼️ 多模态引用 🌍 真实世界知识 📝 文本与动作同步 💰 $0.10/秒
10单次视频生成时长
$0.10每秒输出成本
3单会话连续编辑次数
多模态文本+图像+视频输入

注:当前 Omni Flash 支持最长 10 秒视频生成,更长时长即将推出。音频参考和场景扩展功能暂未在 API 中开放。

一个诚实的注脚:Omni Flash 目前存在一些已知限制——场景切换时角色一致性偶有波动,3 秒以上的视频参考暂无法正确解析。但作为首个公开预览版本,它已经展示了视频生成从"工具操作"走向"对话协作"的潜力。

模型发布是一回事,实际能做什么是另一回事。Google 同时放出了三个 demo,直接展示了双模型串联的威力。

03三个 Demo,看懂模型协同 图像生成 → 视频动画,一次串联

🌍 Anywhere —— 自拍秒变环球旅行 Lite → Omni

  • 上传自拍或照片,Nano Banana 2 Lite 在 4 秒内将你"传送"到数十个地标场景。
  • 点击任意生成图像,Omni Flash 将其动画化为一段动态视频,让静态照片活起来。
体验链路:自拍 → Lite 生成地标背景 → 点击 → Omni Flash 动画化 —— 全程无需手动调整参数。

🏠 Space Lift —— 室内设计,拍照即改 Lite → Omni

  • 上传房间照片,Lite 自动生成多种设计风格的概念图(北欧、工业风、日式等)。
  • 选定风格后,Omni Flash 将静态设计图转为电影级展示视频,让你"走进"新空间。
设计行业场景:从灵感捕捉到空间漫游,两个模型串联完成过去需要多工具协作的流程。

🛍️ Omni 产品工作室 —— 静态图 → 电商视频 Lite → Omni

  • Lite 生成产品展示图,或上传已有商品照片。
  • Omni Flash 将其转换为 cinematic 级别的电商短视频,支持多角度展示。
电商场景:一张静态产品图到一条完整展示视频,生成时间从数小时压缩到分钟级。

三个 demo 展示了一个清晰的信号:Nano Banana 2 Lite 负责快速生成视觉素材,Omni Flash 负责赋予这些素材以时间和动态——两套模型可以独立使用,也可以串联成一条完整的多媒体管线。

两个模型背后,是一张完整的定价与定位拼图。Google 正在用明确的层级划分,覆盖从原型到生产的全场景。

04从 Lite 到 Pro:一张完整的定价拼图

Nano Banana 系列目前共有四个版本,分别对应不同的速度与质量需求:

Nano Banana 2 Lite ⭐ 推荐升级 · 速度优先
4 秒
$0.034
Nano Banana 2 通用工作流 · 质量与速度平衡
~6 秒
$0.05
Nano Banana Pro 复杂专业用例 · 最强控制力
~10 秒
$0.12
Nano Banana(旧版)建议升级至 2 Lite
~9 秒
$0.08

注:延迟数据为文本到图像任务的中位值,成本按每千张 1K 分辨率图像计算。实际表现因提示复杂度有所不同。

加上 Omni Flash 的 0.10 美元/秒视频定价,Google 已经构建了一套从静态图像生成(0.034 美元起)到动态视频生成(0.10 美元/秒)的完整价格体系。对于开发者而言,这意味着可以根据预算和场景灵活选择,而不必在同一个模型上妥协。

更关键的是,Interactions API 支持多轮会话上下文保持,用户可以在单次会话中堆叠最多三次连续编辑——这让复杂工作流中的模型切换变得无缝。

编辑核心判断

Google 正在用价格分层策略,把生成式 AI 从"能不能用"推向"用不用得起"——当图像生成成本降至 0.034 美元、视频生成成本降至 0.10 美元/秒,竞争焦点正在从模型参数比拼,转向系统工程与规模化落地的真实能力。

现在就能用

两款模型已开放:在 Google AI Studio 中直接体验,或通过 Gemini API 集成到你的应用。Nano Banana 2 Lite 已同步上线 AI Mode in Search、Gemini App、NotebookLM 等 Google 消费端产品。

访问 Google AI Studio → 开始构建