Dell Enterprise Hub: オンプレミス AI のデプロイとトレーニング
Dell Enterprise Hubは、企業がセキュアなIT環境内でオープンモデルを直接デプロイできるようにし、セキュリティ、コンプライアンス、プライバシー要件を満たします。モデルをオンプレミスでホストすることで、企業はAI機能に対する完全な所有権と制御権を保持し、顧客データが保護されたままになります。
簡素化されたオンプレミス LLM デプロイメント
Dell Enterprise Hubは、企業がオープンモデルを自社の安全なIT環境内に直接デプロイできるようにし、セキュリティ、コンプライアンス、プライバシー要件を満たします。オンプレミスでモデルをホストすることで、企業はAI機能に対する完全な所有権と制御権を保持し、顧客データが保護されたままになります。
デプロイプロセスの主な特徴は次のとおりです:
- Curated Model Catalog: ハブは、Meta の Llama 3、Mistral AI の Mixtral、Google の Gemma など、先進的なオープンモデルのリストを提供します。
- Hardware Optimization: デプロイ構成は Dell プラットフォーム向けに最適化されており、利用可能なハードウェア、メモリ、接続性を考慮しています。これらの構成は Dell のインフラ上で定期的にテストされ、箱出しのパフォーマンスが保証されます。
- Streamlined Workflow: ユーザーはモデルを選択し、サポートされている Dell プラットフォームと GPU の数を指定し、ターミナルで提供されたスクリプトを実行して API エンドポイントを作成します。
- Unified Access: ハブは Hugging Face アカウント上に構築されているため、既存のモデルウェイト認可(例:Meta や Google からのもの)が自動的に引き継がれます。
オンプレミスモデルのファインチューニング
Dell Enterprise Hubは、企業がオンプレミスでオープンモデルをファインチューニングできるようにし、トレーニングに使用される機密の知的財産や顧客データが企業のセキュアな環境から外部に出ることがないようにします。ファインチューニングされたオープンモデルは、特定のドメイン固有のユースケースにおいて、GPT-4 のようなクローズドモデルを上回る性能を発揮することがあります。
モデルをファインチューニングするには、ユーザーは最適化されたトレーニングコンテナを提供し、トレーニングデータセット(CSV または JSONL 形式)が格納されているローカルパスと、ファインチューニングされたモデルウェイトの保存先パスを指定します。
カスタムモデル統合と API 互換性
このプラットフォームは「Bring Your Own Model」アプローチをサポートしており、ユーザーは独自にトレーニングしたモデルやハブを通じてファインチューニングしたモデルをデプロイできます。モデルがサポートされているアーキテクチャを使用している場合、ユーザーはモデルウェイトへのローカルパスを設定するだけで API エンドポイントとしてデプロイできます。
プロトタイプから本番環境への移行を容易にするため、デプロイされたモデルは OpenAI 互換の Messages API を使用します。これにより、開発者は OpenAI で構築したプロトタイプを、Dell ハードウェア上のセキュアなオンプレミスデプロイへ簡単に移行できます。
ハードウェアとエコシステムのサポート
Dell Enterprise Hub は Hugging Face と主要なハードウェアアクセラレータとの協業を活用しています。さまざまな Dell プラットフォーム構成向けに最適化されたコンテナを利用し、以下のエンジニアリング成果を取り入れています:
- NVIDIA (via
optimum-nvidia) - AMD (via
optimum-amd) - Intel (via
optimum-intelandoptimum-habana)
このエコシステムにより、オープンモデルは異なる AI ハードウェアアクセラレータを活用する幅広い Dell プラットフォーム上で、効率的にデプロイおよびトレーニングできるようになります。