Google 发布新图像与视频模型
Start building with Nano Banana 2 Lite and Gemini Omni Flash
Google DeepMind 推出 Nano Banana 2 Lite 与 Gemini Omni Flash,分别面向高速低成本图像生成和可对话的视频生成编辑。
报道核心
Google DeepMind 发布两项生成式媒体模型:Nano Banana 2 Lite 是 Nano Banana 系列最快、成本最低的 Gemini Image 模型,面向高吞吐、低延迟的图像生成;Gemini Omni Flash 则首次面向开发者开放,支持高质量视频生成与自然语言对话式编辑。
关键细节
Nano Banana 2 Lite 可在 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 使用,也会进入 Search AI Mode、Gemini app、NotebookLM、Google Photos、Stitch、Flow 与 Google Ads 等消费端产品。Google 称其文本生成图像延迟约四秒,每张一千分辨率图片成本为 0.034 美元。Omni Flash 支持文本、图像和视频混合输入,当前以预览形式开放,视频输出价格为每秒 0.10 美元。
行业反应
Google 把图像生成和视频编辑放进同一开发链路,鼓励开发者先用 Nano Banana 快速生成静态画面,再交给 Omni Flash 动画化。模型仍有限制,例如 Omni 目前只支持十秒视频,音频参考与场景延展尚未完全开放,但 SynthID 水印和内容验证会成为 Google 对抗生成式媒体信任问题的重要卖点。
对 AI 行业的影响
Google 正在用速度、成本和分发入口压缩 Runway、Adobe、OpenAI 等生成式媒体竞争者的空间。对开发者生态的影响是,低价图像模型与视频模型的串联会催生更多广告、电商、设计和内容自动化工具,也会让 Gemini 平台更像多媒体生产基础设施。
原文参考
来源:Google DeepMind Blog · 2026-06-30