Hugging Face 和 Google Cloud 战略合作伙伴关系

Hugging Face 和 Google Cloud 已宣布战略合作伙伴关系,以使公司能够在 Google Cloud 基础设施上使用开放模型构建和定制自己的 AI。此合作旨在简化跨各种 Google Cloud 服务部署开放模型的过程,并提升 Hugging Face Hub 的性能和安全性。

通过 CDN 网关实现优化的模型交付

Google Cloud 客户将受益于一个新的用于 Hugging Face 仓库的 CDN 网关。该网关旨在通过直接在 Google Cloud 上缓存 Hugging Face 模型和数据集来降低下载时间并提升供应链的稳健性。

Built using Hugging Face Xet optimized storage and data transfer technologies combined with Google Cloud's storage and networking capabilities, the CDN Gateway provides faster time-to-first-token and simplified model governance for users across Vertex AI, GKE, Cloud Run, and Compute Engine VMs.

跨 Google Cloud AI 服务的集成

Hugging Face 的开放模型已集成到多个 Google Cloud AI 服务中,以提供灵活的部署选项:

  • Vertex AI: 受欢迎的开放模型可通过 Model Garden 进行部署。
  • GKE AI/ML: 模型库可供需要对其 AI 基础设施有更大控制权的客户使用,其中包括由 Hugging Face 维护的预配置环境。
  • Cloud Run GPUs: 这些使得可以对开放模型进行无服务器部署,用于 AI 推理工作负载。

对 Hugging Face 客户的增强

该合作伙伴关系通过以下举措向 Hugging Face 用户扩展功能:

基础设施和硬件加速

Hugging Face 推理端点将集成更多的 Google Cloud 实例,提供新的实例类型和价格降低。此外,Hugging Face 正在努力使 Google 的第七代 TPU(张量处理单元)在开放模型上通过 Hugging Face 库的原生支持变得和使用 GPU 一样易用。

安全和模型治理

Hugging Face 将利用 Google 的安全技术来保护 Hugging Face Hub 上的数百万个模型、数据集和 Spaces。此项安全工作由 VirusTotal、Google Threat Intelligence 和 Mandiant 提供支持。

部署工作流

目标是简化从 Hugging Face Hub 到 Google Cloud 的过渡。这包括简化从 Hugging Face 模型页面直接将企业组织托管的公共和私有模型部署到 Vertex Model Garden 或 GKE。

战略目标

该合作伙伴关系着眼于一个未来:公司通过在自身安全基础设施内托管开放模型来完全控制其 AI。这一愿景得到了 Vertex AI Model Garden、Google Kubernetes Engine 和 Hugging Face Inference Endpoints 发展的支持。

Sources