Hugging Face와 Google Cloud 전략적 파트너십

Hugging Face와 Google Cloud는 기업이 Google Cloud 인프라에서 오픈 모델을 사용하여 자체 AI를 구축하고 맞춤화할 수 있도록 하는 전략적 파트너십を発表했습니다. 이 협력은 다양한 Google Cloud 서비스에서 오픈 모델 배포 프로세스를 간소화하고 Hugging Face Hub의 성능과 보안을 향상시키는 것을 목표로 합니다.

최적화된 모델 전달 via CDN 게이트웨이

Google Cloud 고객은 새로운 CDN 게이트웨이를 통해 Hugging Face 저장소의 이점을 얻을 수 있습니다. 이 게이트웨이는 Hugging Face 모델과 데이터셋을 Google Cloud에 직접 캐시하여 다운로드 시간을 줄이고 공급망의 안정성을 높이도록 설계되었습니다.

Built using Hugging Face Xet 최적화된 스토리지 및 데이터 전송 기술과 Google Cloud의 스토리지 및 네트워킹 기능을 결합하여 구축된 CDN 게이트웨이는 Vertex AI, GKE, Cloud Run, Compute Engine VM 사용자에게 더 빠른 time-to-first-token과 간소화된 모델 거버넌스를 제공합니다.

Google Cloud AI 서비스 전반의 통합

허깅 페이스의 오픈 모델은 유연한 배포 옵션을 제공하기 위해 여러 Google Cloud AI 서비스에 통합됩니다:

  • Vertex AI: 인기 있는 오픈 모델은 Model Garden을 통해 배포할 수 있습니다.
  • GKE AI/ML: AI 인프라에 대한 더 큰 통제가 필요한 고객을 위해 Hugging Face가 유지 관리하는 사전 구성된 환경을 포함한 모델 라이브러리가 제공됩니다.
  • Cloud Run GPUs: 이들은 AI 추론 워크로드를 위한 오픈 모델의 서버리스 배포를 가능하게 합니다.

Hugging Face 고객을 위한 향상 기능

이 파트너십은 다음과 같은 이니셔티브를 통해 허깅 페이스 사용자의 기능을 확장합니다:

인프라 및 하드웨어 가속

Hugging Face Inference Endpoints는 더 많은 Google Cloud 인스턴스와 통합되어 새로운 인스턴스 유형과 가격 인하를 제공합니다. 또한, Hugging Face는 자체 라이브러리의 네이티브 지원을 통해 오픈 모델에 대해 GPU만큼 사용하기 쉬운 Google의 seventh-generation TPUs (Tensor Processing Units)를 만들기 위해 노력하고 있습니다.

보안 및 모델 거버넌스

Hugging Face는 Google의 보안 기술을 활용하여 Hugging Face Hub에 있는 수백만 개의 모델, 데이터셋, 그리고 Spaces를 보호할 것입니다. 이 보안 노력은 VirusTotal, Google Threat Intelligence, 그리고 Mandiantによって 구동됩니다.

배포 워크플로

목표는 Hugging Face Hub에서 Google Cloud로의 전환을 간소화하는 것입니다. 여기에는 Hugging Face 모델 페이지에서 엔터프라이즈 조직에 호스팅된 공개 및 비공개 모델의 배포를 Vertex Model Garden 또는 GKE로 직접 간소화하는 것이 포함됩니다.

전략적 목표

이 파트너십은 기업이 자체 안전한 인프라 내에서 오픈 모델을 호스팅하여 AI에 대한 완전한 통제를 유지하는 미래에 초점을 맞춥니다. 이 비전은 Vertex AI Model Garden, Google Kubernetes Engine, 그리고 Hugging Face Inference Endpoints의 개발로 지원됩니다.

Sources