Nano Banana 2 Lite 与 Gemini Omni Flash 发布
Nano Banana 2 Lite 与 Gemini Omni Flash 发布
Google DeepMind 已发布 Nano Banana 2 Lite 和 Gemini Omni Flash,为开发者提供高速图像生成以及高性价比的视频创作与编辑工具。这些模型通过将快速视觉草图绘制与电影级视频动画相结合,能够实现端到端的媒体体验。
Nano Banana 2 Lite:高吞吐量图像生成
Nano Banana 2 Lite (gemini-3.1-flash-lite-image) 针对快速构思和高速度开发者流水线进行了优化,在这些场景中,速度和成本是主要限制因素。它是替代旧版 Nano Banana (gemini-2.5-flash-image) 模型的推荐方案。
关键性能指标
- 延迟: 该模型可在 4 秒内交付文本到图像的输出。
- 成本效益: 定价为每 1K 分辨率图像 0.034 美元。
尽管专注于速度,该模型仍保持了可靠的提示词遵循能力、清晰的图像内文本渲染以及强大的角色一致性。
Nano Banana 模型家族
- Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image): 针对超低延迟和高容量工作流进行了优化。
- Nano Banana 2 (Gemini 3.1 Flash Image): 平衡性能与成本的通用模型。
- Nano Banana Pro (Gemini 3 Pro Image): 专为需要高级推理和高准确性的专业用例设计。
- Nano Banana (Gemini 2.5 Flash Image): 旧版模型;建议用户升级到 Nano Banana 2 Lite。
Nano Banana 2 Lite 可通过 Google AI Studio、Gemini API 和 Gemini Enterprise Agent Platform 获取,并正在推广至包括 Gemini 应用、Search 中的 AI Mode、NotebookLM、Google Photos、Stitch、Google Flow 和 Google Ads 在内的消费者端产品。
Gemini Omni Flash:对话式视频生成与编辑
Gemini Omni Flash (gemini-omni-flash-preview) 将多模态推理与视频生成相结合。它现在已通过 Gemini API 和 Google AI Studio,以及 Gemini 应用和 Google Flow 提供给开发者使用。
核心能力
- 对话式编辑: 用户可以使用自然语言来精炼和编辑视频。
- 多模态引用: 该模型结合文本、图像和视频输入以保持场景一致性。
- 知识集成: Omni Flash 利用 Gemini 对历史、生物学和叙事逻辑的内部知识来构建视频。
- 动作同步: 通过提示词,可以将文本和图形直接连接到视频动作。
定价与技术限制
Gemini Omni Flash 的定价为每秒视频输出 0.10 美元,与 Veo 3.1 Fast 的成本一致。目前的限制包括:
- 时长: 视频生成目前限制在 10 秒以内。
- 不支持的功能: Gemini API 目前尚不支持音频引用和场景扩展。
- 处理问题: API schema 接受长达 3 秒的视频引用,但目前模型无法正确处理。
- 一致性: 在平移运动或场景切换期间,角色一致性方面存在现有限制。
集成多媒体工作流
开发者可以将 Nano Banana 2 Lite 和 Gemini Omni Flash 串联起来,创建无缝的流水线。一个常见的流程是使用 Nano Banana 2 Lite 进行高速图像生成,然后将该图像作为参考传递给 Gemini Omni Flash,将其动画化为视频。
通过使用 Interactions API,开发者可以维护会话历史和上下文,允许用户执行最多三次连续编辑。
演示应用
- Anywhere: 使用 Nano Banana 2 Lite 通过照片将用户带到地标,然后使用 Omni Flash 将这些图像动画化为剪辑。
- Space Lift: 一款室内设计应用,使用 Nano Banana 2 Lite 生成房间概念,并使用 Omni Flash 创建电影级展示。
- Omni Product Studio: 通过 Gemini Omni 将 Nano Banana 2 Lite 创建的静态电子商务图像转换为电影级视频。
安全与透明度
Gemini Omni 和 Nano Banana 2 Lite 都使用 SynthID 水印技术,以确保可以通过 Gemini 应用、Chrome 中的 Gemini 或 Search 来验证 AI 生成的内容。