Grok Code Fast 1 发布说明 / 更新内容

xAI 发布了 grok-code-fast-1,这是一款从零开始构建、采用全新架构的模型,专门为智能体编程工作流(agentic coding workflows)而设计。该模型旨在降低推理循环和工具调用中常见的延迟,为开发者提供更具响应性的体验。

高速推理与智能体优化

grok-code-fast-1 专为极速响应而设计,使模型能够在用户读完初始思考轨迹(thinking trace)之前执行多次工具调用。这种性能得益于 xAI 推理和超级计算团队的创新,并辅以提示词缓存(prompt caching)优化,在使用启动合作伙伴时,其命中率经常超过 90%。

为了支持智能体工作流,该模型经过训练,能够熟练掌握常用的开发者工具,包括:

  • 文件编辑
  • 终端访问
  • Grep

技术基础与能力

该模型采用全新的架构和富含编程内容的预训练语料库开发而成。后期训练涉及反映真实世界编程任务和 pull requests 的精选数据集。

grok-code-fast-1 在软件开发栈中表现出色,在以下语言中具有特定熟练度:

  • TypeScript
  • Python
  • Java
  • Rust
  • C++
  • Go

其能力范围涵盖了从创建“从零到一”的项目、回答代码库问题到执行精准的缺陷修复(surgical bug fixes)。

性能基准测试与评估

在 SWE-bench Verified 的完整子集中,grok-code-fast-1 使用 xAI 的内部测试框架(harness)取得了 70.8% 的得分。

除了公开的基准测试外,xAI 还采用了一种全面的评估方法,结合了:

  • 由经验丰富的开发者进行的常规人工评估,对日常任务的端到端性能进行评分。
  • 用于追踪行为权衡(behavioral trade-offs)的自动化评估。
  • 用于确保可用性和用户满意度的真实世界测试。

价格与获取方式

grok-code-fast-1 被定位为日常编程任务的经济型选择,其 API 价格如下:

  • Input tokens: $0.20 per million
  • Output tokens: $1.50 per million
  • Cached input tokens: $0.02 per million

该模型已通过 xAI API 通用。此外,通过特定的启动合作伙伴,包括 GitHub Copilot, Cursor, Cline, Roo Code, Kilo Code, opencode, 和 Windsurf,该模型在限时内免费提供。

"In early testing, Grok Code Fast has shown both its speed and quality in agentic coding tasks. Empowering developers with powerful tools is a core part of our mission at GitHub Copilot, and this is a compelling new option for our developers." — Mario Rodriguez, Chief Product Officer, GitHub

未来路线图

在代号为 sonic 的秘密发布之后,xAI 计划根据社区反馈对模型进行快速迭代。目前正在训练中的一个新变体将引入:

  • 多模态输入支持
  • 并行工具调用
  • 扩展的上下文长度

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch