Grok 4 Fast 發佈說明 / 有什麼新功能

xAI 已宣布推出 Grok 4 Fast,這是一款具備高成本效益的推理模型,旨在透過高 token 效率,在企業與消費領域提供前沿水準的性能。

高智能密度與成本效益

Grok 4 Fast 在顯著降低智能成本的同時,實現了前沿水準的性能。透過利用大規模強化學習來最大化「智能密度」,該模型在基準測試中的表現與 Grok 4 相當,但平均使用的思考 token 減少了 40%。

這種 token 效率的提升,結合更低的每 token 定價,使得在 frontier benchmarks 上達到與 Grok 4 相同性能所需的成本降低了 98%。根據 Artificial Analysis 的獨立審查,Grok 4 Fast 在 Artificial Analysis Intelligence Index 中保持了頂尖的 (SOTA) 性價比。

推理基準測試

Benchmark pass@1 Grok 4 Fast Grok 4 Grok 3 Mini (High) GPT-5 (High) GPT-5 Mini (High)
GPQA Diamond 85.7% 87.5% 79.0% 85.7% 82.3%
AIME 2025 (no tools) 92.0% 91.7% 83.0% 94.6% 91.1%
HMMT 2025 (no tools) 93.3% 90.0% 74.0% 93.3% 87.8%
HLE (no tools) 20.0% 25.4% 11.0% 24.8% 16.7%
LiveCodeBench (Jan-May) 80.0% 79.0% 70.0% 86.8% 77.4%

原生工具使用與代理式搜尋

Grok 4 Fast 採用端到端工具使用強化學習 (RL) 進行訓練,使其能夠有效地決定何時調用工具,例如網頁瀏覽或程式碼執行。該模型具備代理式搜尋能力,允許它即時瀏覽網頁與 X,攝取媒體內容(包括 X 上的圖片與影片),並綜合分析結果。

搜尋與研究基準測試

Benchmark pass@1 Grok 4 Fast Grok 4 Grok 3 (No Reasoning)
BrowseComp 44.9% 43.0%
SimpleQA 95.0% 94.0% 82.0%
Reka Research Eval 66.0% 58.0% 37.0%
BrowseComp (zh) 51.2% 45.0% 10.8%
X Bench Deepsearch (zh) 74.0% 66.0% 27.0%
X Browse* 58.0% 53.2% 20.8%

*X Browse 是用於評估在 X 上進行多跳搜尋與瀏覽能力的內部基準測試。

通用領域性能與 LMArena 排名

在 LMArena 的 Search Arena 中,grok-4-fast-search (代號: menlo) 排名第 1,Elo 分數為 1163,領先 o3-search 17 分。在 Text Arena 中,grok-4-fast (代號: tahoe) 排名第 8,表現與 grok-4-0709 相當,並優於其同量級的其他模型(這些模型通常排名第 18 或更後)。

推理模式的統一架構

Grok 4 Fast 引入了統一架構,其中 reasoning (長鏈式思考) 與 non-reasoning (快速回應) 均由相同的模型權重處理,並透過系統提示詞 (system prompts) 進行引導。與以往需要為不同推理模式使用不同模型的迭代版本相比,這種統一化減少了端到端延遲與 token 成本。

提供方式與 API 定價價

Grok 4 Fast 可透過 grok.com 以 FastAuto 模式提供給所有用戶(包括免費用戶)。對於開發者,可透過 xAI API 以兩種模型形式提供:grok-4-fast-reasoninggrok-4-fast-non-reasoning,兩者皆具備 2M token 的上下文窗口。

xAI API 定價

Token Type <128k tokens …128k tokens
Input tokens $0.20 / 1M $0.40 / 1M
Output tokens $0.50 / 1M $1.00 / 1M
Cached input tokens $0.05 / 1M

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch