Scaleway が Hugging Face 推論プロバイダーに追加 – 機能、使用方法、課金
TL;DR
Scaleway は現在、Hugging Face Hub の公式推論プロバイダーとなり、ユーザーは GPT‑OSS、Qwen3、DeepSeek R1、Gemma 3 といった最先端モデルを、ヨーロッパにホストされた低遅延のサーバーレス API を通じて実行できます。
追加が重要な理由
Scaleway を追加することで、Hugging Face 推論の地理的および価格オプションが拡大し、200 ms 未満のファーストトークン遅延、トークン単位で €0.20 M トークンから始まる料金、そしてヨーロッパのデータセンターを経由した直接ルーティングが可能になります。これにより、欧州の開発者はデータ主権の保証を受け、Hugging Face 経由の課金とプロバイダー直接課金の柔軟な選択が可能になります。
サポートされているモデルとアクセスポイント
- 人気のオープンウェイトモデルは
inference_provider=scalewayクエリパラメータで即座に利用可能です。例:openai/gpt-oss-120b、Qwen/Qwen3-Coder-30B-A3B-Instruct、deepseek-ai/DeepSeek-R1-Distill-Llama-70B、google/gemma-3-27b-it。 - Hub 上の Scaleway 組織ページ(
https://huggingface.co/scaleway)には、プロバイダーがホストするすべてのモデルが一覧されています。 - トレンドの Scaleway 支援モデルは
https://huggingface.co/models?inference_provider=scaleway&sort=trendingで閲覧できます。
仕組み
Hub UI での操作
- API キー管理 – ユーザー設定でカスタム Scaleway API キーを保存できます。キーが設定されていない場合、リクエストは自動的に Hugging Face 経由でルーティングされ、HF アカウントに課金されます。
- プロバイダーの優先順位 – プロバイダーの順序を好みで設定できます。モデルウィジェットやコードスニペットはこの順序を尊重します。
- モデルページウィジェット – 各モデルページには、互換性のあるサードパーティプロバイダーが表示され、設定した優先順位でソートされます。
クライアント SDK から
Python (huggingface_hub ≥ 0.34.6)
import os
from huggingface_hub import InferenceClient
client = InferenceClient(
provider="scaleway",
api_key=os.environ["HF_TOKEN"],
)
messages = [{"role": "user", "content": "Write a poem in the style of Shakespeare"}]
completion = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=messages,
)
print(completion.choices[0].message)
api_key を生の Scaleway キーに置き換えることで HF ルーティングをバイパスできます。
JavaScript (@huggingface/inference)
import { InferenceClient } from "@huggingface/inference";
const client = new InferenceClient(process.env.HF_TOKEN);
const chatCompletion = await client.chatCompletion({
model: "openai/gpt-oss-120b",
messages: [{ role: "user", content: "Write a poem in the style of Shakespeare" }],
provider: "scaleway",
});
console.log(chatCompletion.choices[0].message);
両方のスニペットは同じ API インターフェースを示しており、唯一の違いは provider フィールドです。
課金モデル
- ・直接リクエスト – Scaleway API キーを提供すると、課金は Scaleway があなたのアカウントで処理します。
- ・ルーティングリクエスト – Hugging Face トークンで認証すると、Hub がリクエストを転送し、プロバイダーの標準 API 料金を追加マークアップなしで請求します。
- ・PRO クレジット – Hugging Face PRO ユーザーは毎月 $2 相当の推論クレジットを受け取り、Scaleway を含むすべてのプロバイダーで利用できます。
- ・無料プラン – サインインした無料ユーザーは制限された無料クォータを得られます。PRO にアップグレードすると、より高い上限と ZeroGPU アクセスが利用可能になります。
開発者への影響
- ・データ主権 – パリ拠点のデータセンターで推論をホストすることで、EU 中心のコンプライアンス要件を満たします。
- ・パフォーマンス – 200 ms 未満のファーストトークン遅延により、Scaleway はインタラクティブなチャットボットやエージェントパイプラインに適しています。
- ・コスト柔軟性 – トークン単位の課金と直接・ルーティング課金の選択により、チームは支出を最適化できます。
- ・マルチモーダルサポート – 本サービスは構造化出力、関数呼び出し、テキストと画像生成の両方に対応し、ユースケースの範囲を拡大します。
次のステップとフィードバック
- ・高度な設定については、
https://huggingface.co/docs/inference-providers/providers/scalewayの専用ドキュメントをご確認ください。 - ・トレンドモデルリストをテストし、ワークロードの遅延とコストを評価してください。
- ・フィードバックは Hugging Face ディスカッションスペースで提供してください:
https://huggingface.co/spaces/huggingface/HuggingDiscussions/discussions/49。
この投稿は 2025‑09‑19 の公式 Hugging Face 発表を要約しています。
SUMMARY: Scaleway は Hugging Face Hub の公式推論プロバイダーとなり、低遅延でヨーロッパにホストされたサーバーレスアクセスを通じて、最先端モデルを柔軟な課金オプションで提供します。
TITLE: Scaleway が Hugging Face 推論プロバイダーに追加 – 機能、使用方法、課金