Hugging Face と Google Cloud の戦略的パートナーシップ

Hugging Face と Google Cloud は、Google Cloud インフラストラクチャ上でオープンモデルを使用して自社の AI を構築およびカスタマイズできるようにする戦略的パートナーシップを発表しました。このコラボレーションは、さまざまな Google Cloud サービス全体でオープンモデルのデプロイプロセスを簡素化し、Hugging Face Hub のパフォーマンスとセキュリティを向上させることを目的としています。

Optimized Model Delivery via CDN Gateway

Google Cloud のお客様は、Hugging Face リポジトリ向けの新しい CDN ゲートウェイから恩恵を受けます。このゲートウェイは、Google Cloud 上で Hugging Face モデルとデータセットを直接キャッシュすることにより、ダウンロード時間を短縮し、サプライチェーンの堅牢性を高めるように設計されています。

Hugging Face Xet 最適化ストレージおよびデータ転送テクノロジーと Google Cloud のストレージおよびネットワーク機能を組み合わせて構築されたこの CDN ゲートウェイは、Vertex AI、GKE、Cloud Run、Compute Engine VM のユーザーに対して、最初のトークンまでの時間を短縮し、モデルガバナンスを簡素化します。

Integration Across Google Cloud AI Services

Hugging Face のオープンモデルは、柔軟なデプロイオプションを提供するためにいくつかの Google Cloud AI サービスに統合されています:

  • Vertex AI: 人気のオープンモデルは、Model Garden を介してデプロイできます。
  • GKE AI/ML: AI インフラストラクチャに対するより大きな制御が必要なお客様向けに、Hugging Face がメンテナンスするプリコンフィギュアド環境を含むモデルライブラリが利用可能です。
  • Cloud Run GPUs: これらは、AI 推論ワークロード向けのオープンモデルのサーバーレスデプロイを可能にします。

Enhancements for Hugging Face Customers

このパートナーシップは、以下のイニシアティブを通じて Hugging Face ユーザーの機能を拡張します:

Infrastructure and Hardware Acceleration

Hugging Face Inference Endpoints は、より多くの Google Cloud インスタンスと統合され、新しいインスタンスタイプと価格削減を提供します。さらに、Hugging Face は、Hugging Face ライブラリでのネイティブサポートを通じて、Google の第七世代 TPU (Tensor Processing Units) をオープンモデルに対して GPU と同じくらい使いやすくする取り組みを行っています。

Security and Model Governance

Hugging Face は、Google のセキュリティテクノロジーを活用して、Hugging Face Hub 上の何百万ものモデル、データセット、Spaces を保護します。このセキュリティへの取り組みは、VirusTotal、Google Threat Intelligence、Mandiant によって支えられています。

Deployment Workflow

目標は、Hugging Face Hub から Google Cloud への移行を合理化することです。これには、Hugging Face モデルページから直接 Vertex Model Garden または GKE に、エンタープライズ組織がホストするパブリックおよびプライベートモデルのデプロイを簡素化することが含まれます。

Strategic Goals

このパートナーシップは、企業が自社のセキュアなインフラストラクチャ内でオープンモデルをホストすることにより、AI を完全にコントロールできる未来に焦点を当てています。このビジョンは、Vertex AI Model Garden、Google Kubernetes Engine、および Hugging Face Inference Endpoints の開発によって支えられています。

Sources