AWS 與 OpenAI 戰略合作夥伴關係

AWS 與 OpenAI 已宣佈一項多年戰略合作夥伴關係,以便 OpenAI 能立即存取 AWS 基礎設施,擴展其核心 AI 工作負載。此協議金額為 $38 億,為期七年,使 OpenAI 能利用 AWS 的大規模基礎設施擴展運算容量,以支援下一代模型的訓練以及 ChatGPT 的推理服務。

運算基礎設施與擴展

OpenAI 將使用由數十萬塊最先進的 NVIDIA GPU 組成的 AWS 運算資源,並具備擴展至數千萬 CPU 的容量。此基礎設施專門設計用於支援代理工作負載的快速擴展,以及滿足前沿 AI 模型所需的運算需求。

硬體與架構

基礎設施部署具備針對 AI 處理效率優化的架構設計。主要技術規格包括:

  • 硬體: 該部署利用 Amazon EC2 UltraServers 來叢集 NVIDIA GB200s 與 GB300s。
  • 連線: 透過將這些 GPU 在同一網路上叢集,系統在互連系統上實現低延遲效能。
  • 部署時間表: 所有初始容量的目標是在 2026 年底前完成部署,並可選擇在 2027 年及以後進一步擴展。

戰略目標與模型部署

此合作夥伴關係旨在加強支撐下一代 AI 時代所需的運算生態系統。根據 OpenAI 首席執行官 Sam Altman 的說法:「擴展前沿 AI 需要龐大且可靠的運算資源。」

與 Amazon Bedrock 的整合

在此戰略合作夥伴關係之前,OpenAI 的開放權重基礎模型已在 Amazon Bedrock 上提供。這已帶來數千家客戶——包括 Peloton、Thomson Reuters、Comscore、Bystreet、Triomics 和 Verana Health——使用 OpenAI 模型進行以下任務:

  • 代理工作流程
  • 編碼
  • 編碼與科學分析
  • 數學問題解決

運營規模與安全

AWS 提供了 OpenAI 龐大工作負載所需的規模與安全性。AWS 有管理超過 500,000 顆晶片的叢集經驗,這確保了用於運行 ChatGPT 和訓練未來模型的基礎設施的可靠性。

Sources