Hugging Face が Fireworks.ai を推論プロバイダーとして統合

Hugging Face は ハブ で Fireworks.ai をサポートされている推論プロバイダーとして統合しました。この統合により、ユーザーはモデルページ上および Hugging Face ライブラリとツールのエコシステム全体で、幅広いモデルに対して高速なサーバーレス推論にアクセスできるようになります。

サポートされているモデル

Fireworks.ai は、Hugging Face ハブ 上の多数のモデルに対してサーバーレス推論を提供しており、以下を含みます:

  • DeepSeek-R1 (deepseek-ai/DeepSeek-R1)
  • DeepSeek-V3 (deepseek-ai/DeepSeek-V3)
  • Mistral-Small-24B-Instruct-2501 (mistralai/Mistral-Small-24B-Instruct-2501)
  • Qwen2.5-Coder-32B-Instruct (Qwen/Qwen2.5-Coder-32B-Instruct)
  • Llama-3.2-90B-Vision-Instruct (meta-llama/Llama-3.2-90B-Vision-Instruct)

実装とアクセス方法

ユーザーは、次の3つの主要なインターフェースを通じて Fireworks.ai の推論機能にアクセスできます:

ウェブサイト ユーザーインターフェース

ユーザーは、Hugging Face ウェブサイト UI 内で、Fireworks.ai がサポートするすべてのモデルを検索し、直接推論を実行できます。

クライアント SDK

Fireworks.ai は、次の SDK を使用してアプリケーションに統合できます:

  • Python (huggingface_hub): ソースからライブラリをインストールし、InferenceClient の `provider=

Sources