zylon-ai/private-gpt
Complete API layer for private AI applications on local models: RAG, skills, tools, MCP, text-to-sql, and more. Works with any OpenAI-compatible inference server.
何を解決するか
PrivateGPT は、クラウド API に依存せずにローカルモデルを使用して本番用 AI アプリケーションを構築できる、オープンソースの API レイヤーです。Ollama や vLLM などの原始的なローカル推論サーバーと、完全に機能する AI アプリケーションの間のギャップを埋め、RAG、ツール使用、構造化データアクセスなどの高レベルな構成要素を提供します。
動作方法
PrivateGPT は、アプリケーションまたはエージェントと OpenAI 互換の推論サーバーの間の仲介レイヤーとして機能します。モデル自体は実行しません。代わりに OPENAI_API_BASE を介してサーバーに接続し、実際の LLM 処理を処理します。メッセージ、ストリーミング、ツールオーケストレーションのための標準化されたインターフェースを提供するために、Claude API の仕様に従います。
対象ユーザー
ローカル LLM 用の標準化された API を必要とし、バックエンドの基本的な構成要素を再構築せずに、プライベートで自己ホストされた AI 製品、エージェント、ワークフローを構築したい開発者。
主な特徴
- Claude API 互換性: メッセージ、ストリーミング、トークンカウンティングのためのリファレンス API を実装。
- エージェント対応 RAG: ファイルおよびアーティファクトのインジェスト、検索、引用のサポート。
- 組み込みツール: ウェブ検索、ウェブ取得、コード実行を内蔵。カスタムツールおよび MCP コネクタもサポート。
- データアクセス: データベースおよび CSV への構造化アクセスを内蔵し、表形式の分析が可能。
- ワークベンチ UI: テスト、ドキュメントアップロード、API デバッグ用の洗練された UI を提供。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト