Grok 4.3 在 Amazon Bedrock 上发布

xAI 已宣布 Grok 4.3 在 Amazon Bedrock 上正式可用。此次发布将一款高性能前沿模型集成到 AWS 生态系统中,为企业的开发者提供了一款强调低幻觉率和可配置推理能力的模型。

企业级性能与基准测试

Grok 4.3 被定位为构建企业级 AI 代理的领先模型,在多个关键行业基准测试中排名首位:

  • 幻觉率:在前沿模型中实现了最低的幻觉率,在 Artificial Analysis Omniscience 基准测试中排名第一。
  • 工具调用:在 Artificial Analysis Tau2 Telecom 基准测试中排名第一,该测试专门衡量客户支持代理场景下的真实世界工具调用性能。
  • 文档理解:在 Vals AI 法律案例和公司金融基准测试中排名第一,展示了在复杂文档理解任务中的高超能力。

技术能力与上下文窗口

Grok 4.3 拥有 100 万 token 的上下文窗口,能够处理极长的文档和代码库。为优化性能和成本,该模型支持可配置的推理努力程度。开发者可以从四个推理努力级别中进行选择:

  • :针对简单请求优化,实现最大速度。
  • 低、中、高:可扩展的推理级别,可根据所解决问题的难度进行匹配。

定价与成本效益

根据 xAI 的说法,Grok 4.3 每美元提供的智能程度比其他前沿模型高出 2 到 10 倍。该模型在 Amazon Bedrock 上的定价结构如下:

  • 输入:每 100 万个 token 1.25 美元
  • 输出:每 100 万个 token 2.50 美元

可用性

Grok 4.3 现已通过 Amazon Bedrock 安全推理引擎在支持的 AWS 区域对所有开发者开放。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch