Grok 4 Fast 출시 노트 / 새로운 기능
xAI는 높은 토큰 효율성을 바탕으로 기업 및 소비자 영역 전반에서 프런티어급 성능을 제공하도록 설계된 비용 효율적인 추론 모델인 Grok 4 Fast를 발표했습니다. 이 모델은 Grok 4의 학습 내용을 바탕으로 구축되었으며, 더 넓은 사용자층인 개발자와 소비자들에게 고품질 추론을 제공하는 것을 목표로 합니다.
높은 지능 밀도와 비용 효율성
Grok 4 Fast는 지능의 비용을 크게 낮추면서 프런티어급 성능을 달성합니다. 대규모 강화 학습을 활용하여 "지능 밀도"를 극대화함으로써, 이 모델은 벤치마크에서 Grok 4와 대등한 성능을 보여주지만 평균적으로 40% 더 적은 사고(thinking) 토큰을 사용합니다.
이러한 토큰 효율성 향상과 더 낮은 토큰당 가격은, 프런티어 벤치마크에서 Grok 4와 동일한 성능을 달성하는 데 필요한 가격을 98% 절감하는 결과로 이어집니다. Artificial Analysis의 독립적인 검토에 따르면, Grok 4 Fast는 Artificial Analysis Intelligence Index에서 최첨단(SOTA) 가격 대비 지능 비율을 유지하고 있습니다.
추론 벤치마크
| 벤치마크 pass@1 | Grok 4 Fast | Grok 4 | Grok 3 Mini (High) | GPT-5 (High) | GPT-5 Mini (High) |
|---|---|---|---|---|---|
| GPQA Diamond | 85.7% | 87.5% | 79.0% | 85.7% | 82.3% |
| AIME 2025 (no tools) | 92.0% | 91.7% | 83.0% | 94.6% | 91.1% |
| HMMT 2025 (no tools) | 93.3% | 90.0% | 74.0% | 93.3% | 87.8% |
| HLE (no tools) | 20.0% | 25.4% | 11.0% | 24.8% | 16.7% |
| LiveCodeBench (Jan-May) | 80.0% | 79.0% | 70.0% | 86.8% | 77.4% |
네이티브 도구 사용 및 에이전트형 검색
Grok 4 Fast는 도구 사용 강화 학습(RL)을 통해 엔드투엔드(end-to-end)로 학습되어, 웹 브라우징이나 코드 실행과 같은 도구를 언제 호출할지 효과적으로 결정할 수 있습니다. 이 모델은 웹과 X를 실시간으로 탐색하고, 미디어(X의 이미지 및 비디오 포함)를 수용하며, 조사 결과를 종합하는 에이전트형 검색 기능을 갖추고 있습니다.
검색 및 연구 벤치마크
| 벤치마크 pass@1 | Grok 4 Fast | Grok 4 | Grok 3 (No Reasoning) | | --- | --- | --- | --- | --- | | BrowseComp | 44.9% | 43.0% | — | | SimpleQA | 95.0% | 94.0% | 82.0% | | Reka Research Eval | 66.0% | 58.0% | 37.0% | | BrowseComp (zh) | 51.2% | 45.0% | 10.8% | | X Bench Deepsearch (zh) | 74.0% | 66.0% | 27.0% | | X Browse* | 58.0% | 53.2% | 20.8% |
*X Browse는 X에서의 멀티홉(multihop) 검색 및 브라우징 능력을 평가하는 내부 벤치마크입니다.
일반 도메인 성능 및 LMArena 순위
LMArena의 Search Arena에서, grok-4-fast-search (코드명: menlo)는 Elo 점수 1163점으로 1위를 차지하며, o3-search를 17점 차이로 앞섭니다. Text Arena에서는, grok-4-fast (코드명: tahoe)가 8위를 기록하며, grok-4-0709와 대등한 성능을 보여주고, 일반적으로 18위 이하로 기록되는 다른 모델들의 동일 체급 모델들을 능가합니다.
추론 모드용 통합 아키텍처
Grok 4 Fast는 reasoning (긴 사고 과정)과 non-reasoning (빠른 응답) 모드를 모두 동일한 모델 가중치로 처리하고 시스템 프롬프트로 조절하는 통합 아키텍처를를 도입합니다. 이러한 통합은 서로 다른 추론 모드를 위해 별도의 모델이 필요했던 이전 버전들과 비교하여 엔드투엔드 지연 시간(latency)과 토큰 비용을 줄여줍니다.
가용성 및 API 가격 정책
Grok 4 Fast는 무료 사용자를 포함한 모든 사용자가 grok.com을 통해 Fast 및 Auto 모드로 사용할 수 있습니다. 개발자를 위한 xAI API에서는 grok-4-fast-reasoning 및 grok-4-fast-non-reasoning 두 가지 모델을 제공하며, 두 모델 모두 2M 토큰 컨텍스트 창을 지원합니다.
xAI API 가격 정책
| 토큰 유형 | <128k tokens | …128k tokens |
|---|---|---|
| Input tokens | $0.20 / 1M | $0.40 / 1M |
| Output tokens | $0.50 / 1M | $1.00 / 1M |
| Cached input tokens | $0.05 / 1M |
Sources
- OriginalGrok 4 Fast
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch