Grok 4.3 在 Amazon Bedrock 上發布
xAI 已宣布 Grok 4.3 在 Amazon Bedrock 上正式提供。此次發布將高性能的前沿模型整合至 AWS 生態系統中,為企業開發者提供一個強調低幻覺率和可配置推理能力的模型。
企業級性能與基準測試
Grok 4.3 被定位為構建企業級 AI Agent 的領先模型,在多項關鍵行業基準測試中排名第一:
- 幻覺率:它在所有前沿模型中實現了最低的幻覺率,在 Artificial Analysis Omniscience 基準測試中排名第一。
- 工具調用 (Tool-Calling):它在 Artificial Analysis Tau2 Telecom 基準測試中排名第一,該測試專門衡量客戶支援 Agent 場景下的真實工具調用性能。
- 文件理解:它在 Vals AI Case Law 和 Corporate Finance 基準測試中排名第一,展現了在複雜文件理解任務中的高熟練度。
技術能力與上下文窗口
Grok 4.3 具備 100 萬 token 的上下文窗口,能夠處理極長的文件和代碼庫。為了優化性能和成本,該模型支持可配置的推理強度 (reasoning efforts)。開發者可以從四個推理強度等級中進行選擇:
- None:針對簡單請求進行最大速度優化。
- Low, Medium, High:可擴展的推理等級,以匹配所解決問題的難度。
定價與成本效率
根據 xAI 的說法,Grok 4.3 每美元提供的智能程度比其他前沿模型高出 2 到 10 倍。該模型在 Amazon Bedrock 上的定價結構如下:
- Input:$1.25 每 100 萬 token
- Output:$2.50 每 100 萬 token
可用性
Grok 4.3 現在已通過 Amazon Bedrock 安全推理引擎,向所有受支持的 AWS Regions 中的開發者開放。
Sources
- OriginalGrok on Amazon Bedrock
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch