Hugging Face 與 Google Cloud 戰略合作夥伴關係

Hugging Face 與 Google Cloud 已宣布戰略合作夥伴關係,以使公司能夠在 Google Cloud 基礎設施上使用開放模型構建和自訂自己的 AI。此合作旨在簡化在各種 Google Cloud 服務上部署開放模型的流程,並提升 Hugging Face Hub 的效能與安全性。

透過 CDN Gateway 的優化模型交付

Google Cloud 客戶將受益於針對 Hugging Face 儲存庫的新 CDN Gateway。此 gateway 透過在 Google Cloud 上直接快取 Hugging Face 模型與資料集,旨在降低下載時間並提升供應鏈穩健性。

該 CDN Gateway 結合了 Hugging Face Xet 優化的儲存與資料傳輸技術以及 Google Cloud 的儲存與網路功能,為 Vertex AI、GKE、Cloud Run 和 Compute Engine VMs 的使用者提供更快的首個 token 時間以及簡化的模型治理。

跨 Google Cloud AI 服務的整合

來自 Hugging Face 的開放模型已整合到多個 Google Cloud AI 服務中,以提供靈活的部署選項:

  • Vertex AI: 熱門開放模型可透過 Model Garden 進行部署。
  • GKE AI/ML: 模型函式庫可供需要對其 AI 基礎設施擁有更大控制權的客戶使用,其中包括由 Hugging Face 維護的預先配置環境。
  • Cloud Run GPUs: 這些功能可啟用開放模型的無伺服器部署,用於 AI 推理工作負載。

對 Hugging Face 客戶的增強

此合作夥伴關係透過以下舉措將能力擴展至 Hugging Face 使用者:

基礎設施與硬體加速

Hugging Face Inference Endpoints 將整合更多 Google Cloud 執行個體,提供新的執行個體類型與價格降低。此外,Hugging Face 正致力於讓 Google 第七代 TPU(Tensor Processing Units)在開放模型上如同 GPU 一樣易於使用,透過 Hugging Face 庫的原生支援實現。

安全與模型治理

Hugging Face 將運用 Google 的安全技術來保護 Hugging Face Hub 上數以百萬計的模型、資料集與 Spaces。此安全工作由 VirusTotal、Google Threat Intelligence 與 Mandiant 提供支援。

部署工作流程

目標是簡化從 Hugging Face Hub 到 Google Cloud 的過渡。這包括簡化從 Hugging Face 模型頁面直接將企業組織託管的公開與私有模型部署至 Vertex Model Garden 或 GKE。

戰略目標

此合作夥伴關係著眼於未來:公司可透過在自身安全基礎設施內託管開放模型,完全掌控自己的 AI。此願景得到了 Vertex AI Model Garden、Google Kubernetes Engine 與 Hugging Face Inference Endpoints 發展的支援。

Sources