Hugging Face Inference Providers에서의 OVHcloud

개요

OVHcloud는 Hugging Face Hub에서 지원되는 추론 제공업체로 추가되었으며, 사용자는 모델 페이지, HF 웹사이트, 공식 Python 및 JavaScript SDK를 통해 OVHcloud AI Endpoints를 직접 이용해 모델을 실행할 수 있습니다.

작동 방식

웹사이트 UI

HF 계정 설정에서 사용자는 직접 호출을 위해 자신의 OVHcloud API 키를 추가하거나 필드를 비워 Hugging Face를 통해 라우팅되도록 할 수 있으며, 또한 선호도에 따라 제공업체의 순서를 변경할 수 있는데, 이는 모델 페이지에 표시되는 위젯과 코드 스니펫에 영향을 줍니다.

SDK 사용법

huggingface_hub Python 패키지(버전 >= 1.1.5)와 @huggingface/inference JavaScript 패키지는 :ovhcloud 접미사가 있는 모델 식별자를 받아들입니다; 인증은 HF‑라우팅 호출을 위해 HF 토큰으로, 또는 직접 제공업체 호출을 위해 OVHcloud API 키로 수행할 수 있습니다.

청구 및 가격 책정

개인 OVHcloud API 키를 사용할 경우 OVHcloud가 사용자에게 직접 청구되며, Hugging Face를 통해 인증할 경우 HF의 추가 마크업 없이 제공업체의 표준 요금이 적용됩니다. Hugging Face PRO 구독자는 매월 $2의 추론 크레딧을 받아 제공업체 전반에 적용할 수 있습니다.

기술적 기능

OVHcloud AI Endpoints는 완전 관리형 서버리스 API를 통해 gpt-oss, Qwen3, DeepSeek R1, Llama과 같은 프론티어 모델에 대한 액세스를 제공합니다. 이 서비스는 유럽 데이터 센터 인프라에서 실행되어 유럽 사용자에게 데이터 주권과 낮은 지연 시간을 보장합니다. 텍스트 및 이미지 입력에 대해 구조화된 출력, 함수 호출, 멀티모달 처리를 지원합니다. 첫 토큰 지연 시간은 200 ms 미만이며, 플랫폼은 텍스트 생성 및 임베딩 워크로드를 모두 처리합니다.

피드백 및 다음 단계

Hugging Face는 https://huggingface.co/spaces/huggingface/HuggingDiscussions/discussions/49 에 있는 전용 토론 공간을 통해 OVHcloud 통합에 대한 의견을 환영합니다.

Sources