Grok 4 Fast 发布说明 / 新特性
xAI 发布了 Grok 4 Fast,这是一款具有高成本效益的推理模型,旨在通过高 token 效率在企业和消费领域提供前沿水平的性能。该模型基于 Grok 4 的学习成果构建,旨在让更广泛的开发者和消费者群体能够使用高质量的推理能力。
高智能密度与成本效益
Grok 4 Fast 在显著降低智能成本的同时,实现了前沿水平的性能。通过利用大规模强化学习来最大化“智能密度”,该模型在基准测试中实现了与 Grok 4 相当的性能,但平均使用的思考 token 减少了 40%。
这种 token 效率的提升,结合更低的单 token 价格,使得在达到与 Grok 4 在前沿基准测试中相同的性能时,所需的价格降低了 98%。根据 Artificial Analysis 的独立审查,Grok 4 Fast 在 Artificial Analysis Intelligence Index 上保持了最先进的 (SOTA) 性价比。
推理基准测试
| Benchmark pass@1 | Grok 4 Fast | Grok 4 | Grok 3 Mini (High) | GPT-5 (High) | GPT-5 Mini (High) |
|---|---|---|---|---|---|
| GPQA Diamond | 85.7% | 87.5% | 79.0% | 85.7% | 82.3% |
| AIME 2025 (no tools) | 92.0% | 91.7% | 83.0% | 94.6% | 91.1% |
| HMMT 2025 (no tools) | 93.3% | 90.0% | 74.0% | 93.3% | 87.8% |
| HLE (no tools) | 20.0% | 25.4% | 11.0% | 24.8% | 16.7% |
| LiveCodeBench (Jan-May) | 80.0% | 79.0% | 70.0% | 86.8% | 77.4% |
原生工具使用与智能体搜索
Grok 4 Fast 是通过工具使用强化学习 (RL) 进行端到端训练的,这使其能够有效地决定何时调用诸如网络浏览或代码执行等工具。该模型具备智能体搜索能力,允许它实时浏览 X 和 Web,摄取媒体(包括 X 上的图像和视频),并综合发现。
搜索与研究基准测试
| Benchmark pass@1 | Grok 4 Fast | Grok 4 | Grok 3 (No Reasoning) | | --- | --- | --- | --- | --- | | BrowseComp | 44.9% | 43.0% | — | | SimpleQA | 95.0% | 94.0% | 82.0% | | Reka Research Eval | 66.0% | 58.0% | 37.0% | | BrowseComp (zh) | 51.2% | 45.0% | 10.8% | | X Bench Deepsearch (zh) | 74.0% | 66.0% | 27.0% | | X Browse* | 58.0% | 53.2% | 20.8% |
*X Browse 是一个评估在 X 上进行多跳搜索和浏览能力的内部基准测试。
通用领域性能与 LMArena 排名
在 LMArena 的 Search Arena 中,grok-4-fast-search (代码名: menlo) 排名第 1,Elo 分数为 1163,领先 o3-search 17 分。在 Text Arena 中,grok-4-fast (代码名: tahoe) 排名第 ‖, 性能与 grok-4-0709 相当,并优于其同量级模型,这些模型通常排名第 18 位或更后。
统一架构用于推理模式
Grok 4 Fast 引入了一种统一架构,其中 reasoning (长思维链) 和 non-reasoning (快速响应) 均由相同的模型权重和通过系统提示词进行引导。这种统一化相比之前需要为不同推理模式使用单独模型的迭代版本,降低了端到端延迟和 token 成本。
可用性与 API 价格
Grok 4 Fast 可通过 grok.com 以 Fast 和 Auto 模式对所有用户(包括免费用户)开放。对于开发者,它通过 xAI API 以两个模型形式提供:grok-4-fast-reasoning 和 grok-4-fast-non-reasoning,两者均具有 2M token 的上下文窗口。
xAI API 价格
| Token Type | <128k tokens | …128k tokens |
|---|---|---|
| Input tokens | $0.20 / 1M | $0.40 / 1M |
| Output tokens | $0.50 / 1M | $1.50 / 1M |
| Cached input tokens | $0.05 / 1M |
Sources
- OriginalGrok 4 Fast
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch