xAI Grok 4.7 發布說明

xAI 已發布 Grok 4.7,這是一款專為複雜程式碼撰寫與專業知識工作優化之模型。此模型在前代 Grok 4.6 的基礎上,透過使用更大的基礎模型以及專注於需數小時完成任務的訓練方式,實現了顯著提升。

技術改進與訓練

Grok 4.7 建立在比 Grok 4.6 更大的基礎模型之上,並透過延長的強化學習訓練進行訓練。此訓練專注於更具挑戰性的任務組合,特別是強調需耗費數小時完成的問題,使模型能更有效地驗證自身工作並處理更長的上下文。

此外,xAI 已訓練 Grok 4.7 原生理解 Grok Bot 裝置,進而提升其在一般知識工作與對話任務中的表現。

性能基準

Grok 4.7 在多項專業與技術基準上,相較於 Grok 4.6 有顯著提升。其在價格效能方面表現極具競爭力,特別是在長時間執行的程式碼任務上,於 CursorBench 4.0 表現突出。

軟體與電機工程

  • CursorBench 4.0:Grok 4.7 得分 46.3%,高於 Grok 4.6 的 40.4%。
  • DeepSWE v1.1:Grok 4.7 獲得 71.0%(高難度),超越 Grok 4.6 的 65.2%。
  • EEBench:Grok 4.7 得分 64.0%,遠高於 Grok 4.6 的 53.0% 與 GPT-5.6 Sol Max 的 39.4%。

專業知識工作

  • AA Briefcase v1.1:Grok 4.7 得分 1,657,超越 Grok 4.6 的 1,546。
  • Harvey Legal Agent Benchmark:Grok 4.7 得分 19.6%,大幅超越 Grok 4.6 的 15.8%,遠高於 GPT-5.6 Sol Max 的 2.5% 與 Fable 5.1 Max 的 6.7%。
  • HealthBench Professional:Grok 4.7 得分 56.7%,高於 Grok 4.6 的 48.5%。
  • Terminal-Bench 4.0:Grok 4.7 得分 38.0%,遠高於 Grok 4.6 的 20.3%。

安全性與資安

Grok 4.7 實施了全新的安全防護架構,使其成為 xAI 測試過最強的抗越獄與拒絕回應模型。

生物安全與資安防禦

  • 生物安全:模型在 LatchBio 的生物安全基準中取得 62.4% 的高分,位居榜首。
  • 資安:在 HackerBench v0.3 上,Grok 4.7 僅允許 3.3% 的高風險雙重用途提示通過,同時維持對合法安全工作的低拒絕率。

為支援防禦研究,xAI 已向特定資安合作夥伴提供模型紅隊能力的邀請式存取。

價格與可用性

Grok 4.7 可透過 Grok API、Grok Build、Cursor、第三方程式碼裝置、模型路由系統以及雲端平台取得。

定價結構:

  • 標準版:每百萬輸入 token 價格為 2 美元,每百萬輸出 token 價格為 6 美元。
  • 快速變體:輸出速度為標準版的兩倍,價格亦為標準版的兩倍。

Sources