Gemini 3.5 Flash:分析 Google 前沿智慧的轉變

Google 最近推出了 Gemini 3.5 Flash,這是一款旨在帶來「前沿智慧與行動」的模型。雖然官方宣稱其能力有大幅躍升,但開發者社群的反應卻是好奇與懷疑交織,主要聚焦在模型的定價策略以及相較於前代產品的實際價值主張上。

效能承諾

從紙面上看,Gemini 3.5 Flash 提出了相當有說服力的案例。根據 Google 提供的官方基準測試,該模型在多個領域都有顯著提升。有使用者指出,它似乎已超越先前的「Pro」版本,暗示輕量級的「Flash」層級與高容量的「Pro」層級之間的差距正在縮小。

然而,社群對於這些基準測試是否能轉化為實際應用仍有分歧。部分使用者在特定任務上取得成功——例如產生複雜的動畫 SVG——但也有人認為模型可能被「benchmaxxed」——即專門為在公開基準測試中取得高分而優化,而非展現真正的通用智慧。

定價爭議

Gemini 3.5 Flash 發布中最具爭議的點在於其定價。社群成員指出,與前代產品相比,成本大幅上升。

根據使用者資料,Flash 系列的價格走勢顯著上揚:

  • Gemini 2.5 Flash: 每百萬 token(輸入/輸出)$0.30 / $2.50
  • Gemini 3.0 Flash Preview: 每百萬 token $0.50 / $3.00
  • Gemini 3.5 Flash Preview: 每百萬 token $1.50 / $9.00

這相當於較 3.0 Flash 預覽版提升了 3 倍的價格。此變化讓人開始質疑「Flash」模型的定義。歷史上,Flash 被定位為低智慧、速度快且價格低廉的選項。如今 3.5 Flash 的價格已與 Gemini 2.5 Pro 相當,價值主張因此根本改變。

"我認為 'flash' 模型的概念正在改變…如果他們能在保持價格穩定的同時帶來漸進的知識提升,我會很感激。"

價值 vs. 速度

來自 Artificial Analysis 等平台的獨立分析為此事火上加油。部分報告指出,儘管是「Flash」模型,3.5 Flash 執行某些測試套件的成本實際上比 3.1 Pro 更高。具體比較顯示,執行同一測試套件 3.5 Flash 需花費 $1,551,而 3.1 Pro 為 $892,且在某些智慧指標上排名較低。

這形成了一個悖論:模型速度顯著提升(約 2.5 倍),但早期 Flash 模型所具備的「每美元效能」似乎已不復存在。這導致社群產生各種推測,有人認為模型可能只是透過投入更多計算資源來取得結果,而非代表根本性的架構突破。

競爭格局

儘管有定價顧慮,仍有觀察者指出,Google 持續聚焦於更小、更高效的模型,而競爭對手如 OpenAI 與 Anthropic 則在其最先進(SOTA)模型上提升計算需求。若 Google 能在文字效能的「Pareto 前緣」——成本、速度與智慧之間的平衡——保持領先,這一策略或許能獲得回報。

然而,對專業開發者而言門檻仍然很高。對於使用大型語言模型進行大量程式碼編寫的使用者而言,主要的基準已不僅是一般分數,而是模型是否能與專門工具如 Claude Code 競爭。除非 Gemini 3.5 Flash 能證明其具備相同層級的特化能力,部分高階使用者仍對回歸 Google 生態系持保留態度。

最後思考

Gemini 3.5 Flash 代表了 Google AI 策略的一次轉向。透過將 Flash 層級推向更高的智慧與更高的成本,Google 正在傳遞它更重視「前沿智慧」而非經濟實惠的工具。開發者是否會接受這個更昂貴的基線,或是轉向其他模型——包括開源或國際競爭者——將取決於模型的效能提升是否足以證明 3 倍價格上漲的合理性。

Sources