ENTERPILOT/GoModel
AI gateway / AI control plane / AI proxy written in Go. Unified OpenAI-compatible and Anthropic-compatible API for OpenAI, Anthropic, Gemini, Groq, xAI, Ollama, vLLM and more. A LiteLLM alternative with observability, guardrails, streaming, cost tracking, intelligent routing, sticky sessions, failover, real-time logs and usage tracking. Prod ready.
何を解決するか
GoModel は複数のLLMプロバイダーの管理を簡素化するためのAIゲートウェイです。プロバイダーロックイン、予測不能なコスト、AIアプリケーションにおける集中型の可視性の欠如という問題に対処します。さまざまなAIモデルとのやり取りに一貫したインターフェースを提供するとともに、コスト削減と信頼性向上のためのツールも提供します。
動作方法
GoModel は、あなたのアプリケーションとさまざまなAIプロバイダー(OpenAI、Anthropic、Google Geminiなど)の間のプロキシ層として機能します。OpenAI互換またはAnthropic互換のフォーマットでリクエストを受け取り、ターゲットプロバイダーにルーティングします。管理用ダッシュボードを備えており、.envファイル、config.yaml、または管理インターフェースによる構成が可能です。
対象ユーザー
複数のLLMプロバイダーを管理し、支出を追跡し、フェイルオーバーとロードバランシングにより高可用性を確保したい開発者やチーム。
主な特徴
- 一貫したAPI: OpenAI、Anthropic、xAI、Google Geminiなど多数のプロバイダーをサポートし、公式SDKとの互換性も確保。
- コストと予算管理: リクエストごとのコスト見積もり、使用状況分析、ユーザー、チーム、キーごとのハードな支出制限機能。
- キャッシュ: 精確な応答キャッシュと意味的応答キャッシュをサポートし、コストと繰り返しのプロンプト費用を削減。
- 信頼性ツール: バックアッププロバイダーへの自動フェイルオーバー、リトライ、回路ブレーカー、プロバイダーキーの自動ローテーションを備える。
- 可視性: プロメテウスメトリクス、OpenTelemetryトレース、監査ログを中央ダッシュボードから提供。
- 高度なルーティング: ロードバランシング用の仮想モデルと、リクエストの難易度に基づいて分類し、最も安価で健全なプロバイダーを選択するインテリジェントルーティング(Pro版)。
- 拡張性: ガードレール、応答フィルター、ルーティング戦略用のプラグインをサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト