Scaleway が Hugging Face 推論プロバイダーに追加 – 機能、使用方法、課金

TL;DR

Scaleway は現在、Hugging Face Hub の公式推論プロバイダーとなり、ユーザーは GPT‑OSS、Qwen3、DeepSeek R1、Gemma 3 といった最先端モデルを、ヨーロッパにホストされた低遅延のサーバーレス API を通じて実行できます。

追加が重要な理由

Scaleway を追加することで、Hugging Face 推論の地理的および価格オプションが拡大し、200 ms 未満のファーストトークン遅延、トークン単位で €0.20 M トークンから始まる料金、そしてヨーロッパのデータセンターを経由した直接ルーティングが可能になります。これにより、欧州の開発者はデータ主権の保証を受け、Hugging Face 経由の課金とプロバイダー直接課金の柔軟な選択が可能になります。

サポートされているモデルとアクセスポイント

  • 人気のオープンウェイトモデルは inference_provider=scaleway クエリパラメータで即座に利用可能です。例: openai/gpt-oss-120bQwen/Qwen3-Coder-30B-A3B-Instructdeepseek-ai/DeepSeek-R1-Distill-Llama-70Bgoogle/gemma-3-27b-it
  • Hub 上の Scaleway 組織ページ(https://huggingface.co/scaleway)には、プロバイダーがホストするすべてのモデルが一覧されています。
  • トレンドの Scaleway 支援モデルは https://huggingface.co/models?inference_provider=scaleway&sort=trending で閲覧できます。

仕組み

Hub UI での操作

  1. API キー管理 – ユーザー設定でカスタム Scaleway API キーを保存できます。キーが設定されていない場合、リクエストは自動的に Hugging Face 経由でルーティングされ、HF アカウントに課金されます。
  2. プロバイダーの優先順位 – プロバイダーの順序を好みで設定できます。モデルウィジェットやコードスニペットはこの順序を尊重します。
  3. モデルページウィジェット – 各モデルページには、互換性のあるサードパーティプロバイダーが表示され、設定した優先順位でソートされます。

クライアント SDK から

Python (huggingface_hub ≥ 0.34.6)

import os
from huggingface_hub import InferenceClient

client = InferenceClient(
    provider="scaleway",
    api_key=os.environ["HF_TOKEN"],
)

messages = [{"role": "user", "content": "Write a poem in the style of Shakespeare"}]

completion = client.chat.completions.create(
    model="openai/gpt-oss-120b",
    messages=messages,
)
print(completion.choices[0].message)

api_key を生の Scaleway キーに置き換えることで HF ルーティングをバイパスできます。

JavaScript (@huggingface/inference)

import { InferenceClient } from "@huggingface/inference";

const client = new InferenceClient(process.env.HF_TOKEN);

const chatCompletion = await client.chatCompletion({
  model: "openai/gpt-oss-120b",
  messages: [{ role: "user", content: "Write a poem in the style of Shakespeare" }],
  provider: "scaleway",
});

console.log(chatCompletion.choices[0].message);

両方のスニペットは同じ API インターフェースを示しており、唯一の違いは provider フィールドです。

課金モデル

  • 直接リクエスト – Scaleway API キーを提供すると、課金は Scaleway があなたのアカウントで処理します。
  • ルーティングリクエスト – Hugging Face トークンで認証すると、Hub がリクエストを転送し、プロバイダーの標準 API 料金を追加マークアップなしで請求します。
  • PRO クレジット – Hugging Face PRO ユーザーは毎月 $2 相当の推論クレジットを受け取り、Scaleway を含むすべてのプロバイダーで利用できます。
  • 無料プラン – サインインした無料ユーザーは制限された無料クォータを得られます。PRO にアップグレードすると、より高い上限と ZeroGPU アクセスが利用可能になります。

開発者への影響

  • データ主権 – パリ拠点のデータセンターで推論をホストすることで、EU 中心のコンプライアンス要件を満たします。
  • パフォーマンス – 200 ms 未満のファーストトークン遅延により、Scaleway はインタラクティブなチャットボットやエージェントパイプラインに適しています。
  • コスト柔軟性 – トークン単位の課金と直接・ルーティング課金の選択により、チームは支出を最適化できます。
  • マルチモーダルサポート – 本サービスは構造化出力、関数呼び出し、テキストと画像生成の両方に対応し、ユースケースの範囲を拡大します。

次のステップとフィードバック

  • ・高度な設定については、https://huggingface.co/docs/inference-providers/providers/scaleway の専用ドキュメントをご確認ください。
  • ・トレンドモデルリストをテストし、ワークロードの遅延とコストを評価してください。
  • ・フィードバックは Hugging Face ディスカッションスペースで提供してください: https://huggingface.co/spaces/huggingface/HuggingDiscussions/discussions/49

この投稿は 2025‑09‑19 の公式 Hugging Face 発表を要約しています。

SUMMARY: Scaleway は Hugging Face Hub の公式推論プロバイダーとなり、低遅延でヨーロッパにホストされたサーバーレスアクセスを通じて、最先端モデルを柔軟な課金オプションで提供します。

TITLE: Scaleway が Hugging Face 推論プロバイダーに追加 – 機能、使用方法、課金

Sources