Grok 4 Fast リリースノート / 新機能

xAIは、エンタープライズおよびコンシューマーの両方の領域において、高いトークン効率でフロンティアレベルの性能を提供する、コスト効率の高い推論モデルであるGrok 4 Fastを発表しました。このモデルはGrok 4からの学習に基づき、高品質な推論をより広範な開発者やコンシューマーのユーザーベースに提供することを目指しています。

高い知能密度とコスト効率

Grok 4 Fastは、知能のコストを大幅に削減しながら、フロンティアレベルの性能を実現します。大規模な強化学習を利用して「知能密度」を最大化することで、モデルはベンチマークにおいてGrok 4に匹敵する性能を達成していますが、思考トークンを平均で40%削減しています。

このトークン効率の向上は、トークンあたりの低価格設定と相まって、フロンティアベンチマークにおいてGrok 4と同じ性能を達成するために必要な価格を98%削減することにつながります。Artificial Analysisによる独立したレビューによると、Grok 4 FastはArtificial Analysis Intelligence Indexにおいて、最先端(SOTA)の価格対知能比を維持しています。

推論ベンチマーク

Benchmark pass@1 Grok 4 Fast Grok 4 Grok 3 Mini (High) GPT-5 (High) GPT-5 Mini (High)
GPQA Diamond 85.7% 87.5% 79.0% 85.7% 82.3%
AIME 2025 (no tools) 92.0% 91.7% 83.0% 94.6% 91.1%
HMMT 2025 (no tools) 93.3% 90.0% 74.0% 93.3% 87.8%
HLE (no tools) 20.0% 25.4% 11.0% 24.8% 16.7%
LiveCodeBench (Jan-May) 80.0% 79.0% 70.0% 86.8% 77.4%

ネイティブなツール利用とエージェンティック・サーチ

Grok 4 Fastは、ツール利用の強化学習(RL)を用いてエンドツーエンドでトレーニングされており、ウェブブラウジングやコード実行などのツールをいつ呼び出すべきかを効果的に判断できます。このモデルは、ウェブやXをリアルタイムで閲覧し、メディア(X上の画像や動画を含む)を取り込み、調査結果を統合するエージェンティック・サーチ機能を提供します。

検索とリサーチ・ベンチマーク

| Benchmark pass@1 | Grok 4 Fast | Grok 4 | Grok 3 (No Reasoning) | | --- | --- | --- | --- | --- | | BrowseComp | 44.9% | 43.0% | — | | SimpleQA | 95.0% | 94.0% | 82.0% | | Reka Research Eval | 66.0% | 58.0% | 37.0% | | BrowseComp (zh) | 51.2% | 45.0% | 10.8% | | X Bench Deepsearch (zh) | 74.0% | 66.0% | 27.0% | | X Browse* | 58.0% | 53.2% | 20.8% |

*X Browseは、Xにおけるマルチホップ検索およびブラウジング機能の評価を行う内部ベンチマークです。

一般ドメインの性能とLMArenaランキング

LMArenaのSearch Arenaにおいて、grok-4-fast-search (コード名: menlo) はElo 1163で1位にランクインしており、o3-search を17ポイントの差でリードしています。Text Arenaでは、grok-4-fast (コード名: tahoe) は8位にランクインしており、grok-4-0709 と同等の性能を発揮し、通常18位以下にランクされる他のモデルの同重量級モデルの中で最も優れた性能を示しています。

推論モードのための統合アーキテクチャ

Grok 4 Fastは、reasoning (長い思考の連鎖) と non-reasoning (迅速な応答) の両方を、同一のモデル重みで処理し、システムプロンプトを介して制御する統合アーキテクチャを導入しています。この統合により、異なる推論モードのために別途モデルが必要であった以前のバージョンと比較して、エンドツーエンドのレイテンシとトークンコストを削減できます。

利用可能範囲とAPI価格設定

Grok 4 Fastは、無料ユーザーを含むすべてのユーザーが、grok.comを通じてFast および Auto モードで利用可能です。開発者向けには、xAI APIを通じて、grok-4-fast-reasoninggrok-4-fast-non-reasoning の2つのモデルとして提供されており、どちらも2Mトークンのコンテキストウィンドウを備えています。

xAI API 価格設定

Token Type <128k tokens …128k tokens
Input tokens $0.20 / 1M $0.40 / 1M
Output tokens $0.50 / 1M $1.00 / 1M
Cached input tokens $0.05 / 1M

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch