Gemini 3 Flash 发行说明 / 新功能
Google DeepMind 已发布 Gemini 3 Flash,这是一种旨在以高速和高效提供前沿级智能的模型。Gemini 3 Flash 将 Gemini 3 Pro 模型的推理能力集成到轻量级架构中,使得下一代 AI 能够以极低的成本在 Google 产品和开发者平台上普及。
前沿推理和多模态性能
Gemini 3 Flash 在博士级推理和知识基准上的表现可与更大的前沿模型相媲美,并超越 Gemini 2.5 Pro。关键基准结果包括:
- GPQA Diamond: 90.4%
- Humanity’s Last Exam: 33.7%(未使用工具)
- MMMU Pro: 81.2%(与 Gemini 3 Pro 相当)
除了原始基准,该模型在设计时考虑了效率。在最高思考级别运行时,Gemini 3 Flash 可以根据复杂性调节其处理时间。在典型流量下,它平均使用比 Gemini 2.5 Pro 少 30% 的令牌来完成日常任务,同时性能更高。
速度、成本和效率
Gemini 3 Flash 针对低延迟应用进行了优化,根据 Artificial Analysis 基准测试,其速度比 Gemini 2.5 Pro 快 3 倍。这种速度使其特别适用于代理工作流和响应式交互式应用。
定价结构:
- 输入令牌: 每 100 万令牌 0.50 美元
- 输出令牌: 每 100 万令牌 3.00 美元
- 音频输入: 每 100 万令牌 1.00 美元
开发者能力和代理编码
Gemini 3 Flash 针对迭代开发和高频工作流进行了优化。它在编码代理能力方面表现出显著优势,在 SWE-bench Verified 上获得 78% 的得分,这超过了 Gemini 2.5 系列和 Gemini 3 Pro。
这些能力使开发者能够构建更智能的应用,例如游戏内助手或 A/B 测试实验,这些应用需要深度推理和快速响应时间的结合。该模型特别针对复杂视频分析、数据提取和视觉问答。
全球集成和消费者访问
Gemini 3 Flash 正在整个 Google 生态系统中集成,以替换旧模型并提升用户体验:
- Gemini 应用: Gemini 3 Flash 现在是默认模型,取代了 Gemini 2.5 Flash。这使用户能够将非结构化的语音想法转化为可运行的应用原型,或将多模态内容(视频和图像)转化为可操作的计划。
- 搜索中的 AI 模式: 该模型是搜索中 AI 模式的新默认模型,改进了对细微查询的解析,并提供综合且易于视觉消化的响应,这些响应整合了实时本地信息和网络链接。
可用性
Gemini 3 Flash 可通过以下渠道进行预览:
- 开发者工具: Google AI Studio 中的 Gemini API、Google Antigravity、Vertex AI、Gemini Enterprise、Gemini CLI 和 Android Studio。
- 消费者产品: Gemini 应用和搜索中的 AI 模式。