OpenAI 與 Cerebras 低延遲推論合作夥伴關係

OpenAI 已與 Cerebras 合作,將專為 AI 設計的系統整合到其推論堆疊中,以降低延遲並加速模型輸出。此合作旨在實現即時 AI 互動,讓使用者能處理更高價值的工作負載並獲得更自然的互動。

計算策略與低延遲推論

OpenAI 的計算策略著重於打造彈性的投資組合,將特定系統與特定工作負載相匹配。透過整合 Cerebras 的硬體,OpenAI 為其平台加入了專用的低延遲推論解決方案。這使得使用者在產生程式碼、創建圖像或執行 AI 代理時能獲得更快速的回應,縮短請求與回應之間的迴路。

Cerebras 硬體架構

Cerebras 透過使用單一巨型晶片,結合龐大的運算、記憶體與頻寬,實現高速推論。此架構消除傳統硬體常見的瓶頸,專為加速 AI 模型的長輸出而設計。

部署時間表與實施

OpenAI 將分階段將此低延遲能力整合到其推論堆疊中,並在各種工作負載中擴展。此能力將於 2028 年前分多批次上線。

執行層觀點

「OpenAI 的計算策略是打造彈性的投資組合,將合適的系統與合適的工作負載相匹配。Cerebras 為我們的平台加入了專用的低延遲推論解決方案。這意味著更快的回應、更自然的互動,以及更堅實的基礎,讓即時 AI 能擴展至更多使用者,」OpenAI 的 Sachin Katti 表示。

「我們很高興能與 OpenAI 合作,將全球領先的 AI 模型帶到全球最快的 AI 處理器上。正如寬頻改變了互聯網,即時推論將改變 AI,開啟全新的模型建構與互動方式,」Cerebras 的共同創辦人兼執行長 Andrew Feldman 表示。

Sources