Gemini 3.5 Flash 版本說明 / 新功能

Google DeepMind 推出了 Gemini 3.5,這是一個新系列的模型,旨在執行複雜的代理工作流程。此系列的首次發佈——Gemini 3.5 Flash,針對程式編寫與代理執行中的高速、長期任務進行了優化,提供前沿水平的效能,且沒有大型旗艦模型通常伴隨的延遲。

Gemini 3.5 Flash 效能與基準測試

Gemini 3.5 Flash 提供與大型旗艦模型相當的智慧,同時保有 Flash 系列的高速。其每秒輸出 token 數比其他前沿模型快 4 倍。

關鍵效能基準包括:

  • Terminal-Bench 2.1:76.2%
  • GDPval-AA:1656 Elo
  • MCP Atlas:83.6%
  • CharXiv Reasoning(多模態理解):84.2%

在這些領域中,3.5 Flash 超越了 Gemini 3.1 Pro,成為迄今為止 Google 最強大的代理與程式編寫模型。

代理能力與工作流程自動化

Gemini 3.5 Flash 為需要快速規劃、建構與迭代的長期代理任務而設計。透過縮短複雜任務(例如維護程式碼庫、開發應用程式或編寫財務文件)所需的時間,它能在極短的時間內完成工作,且成本低於其他前沿模型的一半以下。

結合更新的 Antigravity 框架後,3.5 Flash 可部署協作子代理,在監督下執行多步驟工作流程與程式編寫任務。

整合與實際應用

Gemini 3.5 Flash 現已成為全球 Google Search 中 Gemini 應用程式與 AI 模式的預設模型。它同時為多項新功能提供動力:

  • Gemini Spark:一個全天候運作的個人 AI 代理,協助使用者在數位生活中導航並代為執行操作。目前正向受信任的測試者推出,預計下週為美國的 Google AI Ultra 訂閱者提供 Beta 版。
  • Search Information Agents:新型代理,全天候運作,提供更智慧的體驗與動態生成式使用者介面。
  • Enterprise Automation:銀行與金融科技公司使用此模型自動化多週的工作流程,資料科學團隊則利用它從複雜的資料環境中提取洞見。

安全性與防護措施

Gemini 3.5 採用了 Frontier Safety Framework 進行開發。模型具備加強的網路與 CBRN(化學、生物、放射與核)防護措施,以減少有害內容的產生並降低對安全查詢的錯誤拒絕。這些改進源自先進的安全訓練與可解釋性工具,使開發者能在回應產生前分析 AI 的內部推理。

可用性

Gemini 3.5 Flash 已透過以下平台普遍提供:

  • For Developers:Google Antigravity、Google AI Studio 中的 Gemini API,以及 Android Studio。
  • For Enterprises:Gemini Enterprise Agent Platform 與 Gemini Enterprise。
  • For General Users:Gemini 應用程式與 Search 中的 AI 模式。

Google DeepMind 亦宣布 Gemini 3.5 Pro 目前正於內部使用,預計下個月正式發布。

Sources