Grok 4.3 在 Amazon Bedrock 上發布

xAI 已宣布 Grok 4.3 在 Amazon Bedrock 上正式提供。此次發布將高性能的前沿模型整合至 AWS 生態系統中,為企業開發者提供一個強調低幻覺率和可配置推理能力的模型。

企業級性能與基準測試

Grok 4.3 被定位為構建企業級 AI Agent 的領先模型,在多項關鍵行業基準測試中排名第一:

  • 幻覺率:它在所有前沿模型中實現了最低的幻覺率,在 Artificial Analysis Omniscience 基準測試中排名第一。
  • 工具調用 (Tool-Calling):它在 Artificial Analysis Tau2 Telecom 基準測試中排名第一,該測試專門衡量客戶支援 Agent 場景下的真實工具調用性能。
  • 文件理解:它在 Vals AI Case Law 和 Corporate Finance 基準測試中排名第一,展現了在複雜文件理解任務中的高熟練度。

技術能力與上下文窗口

Grok 4.3 具備 100 萬 token 的上下文窗口,能夠處理極長的文件和代碼庫。為了優化性能和成本,該模型支持可配置的推理強度 (reasoning efforts)。開發者可以從四個推理強度等級中進行選擇:

  • None:針對簡單請求進行最大速度優化。
  • Low, Medium, High:可擴展的推理等級,以匹配所解決問題的難度。

定價與成本效率

根據 xAI 的說法,Grok 4.3 每美元提供的智能程度比其他前沿模型高出 2 到 10 倍。該模型在 Amazon Bedrock 上的定價結構如下:

  • Input:$1.25 每 100 萬 token
  • Output:$2.50 每 100 萬 token

可用性

Grok 4.3 現在已通過 Amazon Bedrock 安全推理引擎,向所有受支持的 AWS Regions 中的開發者開放。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch