BerriAI/litellm
The fastest, litest AI Gateway. Rust core with Python SDK. Call 100+ LLM APIs in OpenAI (or native) format with cost tracking, guardrails, load balancing, and logging [Bedrock, Azure, OpenAI, Anthropic, OpenAI, VertexAI, vLLM, Nvidia NIM]
何を解決するか
LiteLLM は複数のLLMプロバイダーを管理する複雑さを簡素化します。各モデルごとに異なるSDK、認証パターン、リクエスト形式を扱う必要がなくなり、OpenAI形式を使用して100以上のLLMプロバイダーを一元的に呼び出せる単一の統合インターフェースを提供します。
動作方法
LiteLLMは以下の2つの方法で実装できます:
- Python SDK:コード内に直接統合可能なライブラリ。GPT-4o、Claude Sonnetなど、さまざまなモデルを一貫した構文で呼び出せます。
- AIゲートウェイ(プロキシサーバー):自己ホスティング可能な中央集権的なサービス。特定のプロバイダーに必要な形式にリクエストを変換するプロキシとして機能し、仮想キー、コスト追跡、ロードバランシング、ガードレールなどのエンタープライズ機能を提供します。
さらに、エージェント呼び出しにA2Aプロトコルをサポートし、MCP(Model Context Protocol)ブリッジを提供してMCPサーバーを任意のLLMに接続できます。
対象ユーザー
複数のLLMプロバイダーを使用し、プロバイダーの縛りを避け、モデルの切り替え時にコードの再記述を減らしたい開発者や組織向けです。チーム全体のLLM呼び出しを一元管理したい場合にも最適です。
主な特徴
- 統合API:100以上のLLMに対して1つのインターフェースを提供し、プロバイダー固有のSDKの必要性を排除します。
- OpenAI互換性:即座に置き換え可能な互換性により、コードの再記述なしにプロバイダーを切り替えられます。
- エンタープライズゲートウェイ:仮想キー、コスト追跡、管理ダッシュボードを含みます。
- 高パフォーマンス:1k RPSで8msのP95レイテンシ。
- エージェント・ツールサポート:A2AエージェントおよびMCPツールの統合をサポートします。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト