Gemini 3 Flash 版本說明 / 新功能
Google DeepMind 已發布 Gemini 3 Flash,這是一個設計用來提供高速與高效率的前沿級智能的模型。Gemini 3 Flash 將 Gemini 3 Pro 模型的推理能力整合到輕量級架構中,使得下一代 AI 能以極低的成本在 Google 產品與開發者平台上變得可及。
前沿推理與多模態表現
Gemini 3 Flash 在博士級推理與知識基準上的表現可與更大的前沿模型相媲美,並優於 Gemini 2.5 Pro。主要基準結果包括:
- GPQA Diamond: 90.4%
- Humanity’s Last Exam: 33.7% (無工具)
- MMMU Pro: 81.2% (與 Gemini 3 Pro 相當)
除了原始基準外,該模型在設計時考慮了效率。在最高思考層級運行時,Gemini 3 Flash 可以根據複雜度調整其處理時間。在典型流量下,它平均使用比 Gemini 2.5 Pro 少 30% 的 token 來完成日常任務,同時達到更高的表現。
速度、成本與效率
Gemini 3 Flash 已針對低延遲應用進行優化,根據 Artificial Analysis 基準測試,其速度比 Gemini 2.5 Pro 快 3 倍。此速度使其特別適合代理工作流程和響應式互動應用。
定價結構:
- Input Tokens: 每 100 萬個 token $0.50
- Output Tokens: 每 100 萬個 token $3.00
- Audio Input: 每 100 萬個 token $1.00
開發者能力與代理編碼
Gemini 3 Flash 已針對迭代開發和高頻工作流程進行優化。它在編碼代理能力方面展現顯著優勢,在 SWE-bench Verified 上獲得 78% 的分數,超越 Gemini 2.5 系列和 Gemini 3 Pro。
這些能力使開發者能夠構建更智慧的應用程式,例如遊戲內助理或 A/B 測試實驗,這些應用需要深度推理與快速響應時間的結合。該模型專門針對複雜影片分析、資料擷取和視覺問答進行優化。
全球整合與消費者存取
Gemini 3 Flash 正在整合到 Google 生態系統中,以取代舊版模型並提升使用者體驗:
- Gemini App: Gemini 3 Flash 現在是預設模型,取代了 Gemini 2.5 Flash。這使得使用者能夠將非結構化的語音想法轉換為可運作的應用程式原型,或將多模態內容(影像和圖片)轉換為可執行的計畫。
- AI Mode in Search: 該模型現在是 AI Mode in Search 的新預設模型,提升了對細膩查詢的解析能力,並提供綜合且易於視覺消化的回應,整合即時本地資訊與網路連結。
可用性
Gemini 3 Flash 透過以下管道提供預覽版:
- Developer Tools: Google AI Studio 中的 Gemini API、Google Antigravity、Vertex AI、Gemini Enterprise、Gemini CLI 以及 Android Studio。
- Consumer Products: Gemini 應用程式與 AI Mode in Search。