katanemo/plano
Plano is an AI-native proxy server and data plane for agentic apps. Smart LLM routing, observability, agent orchestration, and guardrails so you stay focused on your agents core logic.
What it solves
Plano は、デモから本番へエージェント AI アプリケーションを移行する際に発生する「隠れたミドルウェア」負荷を解消します。開発者が意図分類器、ルーティングロジック、プロバイダー固有の API アダプタ、複数エージェントに跨る可観測性計装といった定型的な配管作業を手動で構築する必要がなくなります。
How it works
Plano は Envoy 上に構築された AI ネイティブのプロキシサーバー兼データプレーンとして機能し、オーケストレーションと配信の関心事をアプリケーションコードから切り離し、プロセス外レイヤーに移します。開発者は YAML 設定ファイルでエージェントとモデルプロバイダーを定義し、Plano がエージェント間の低レイテンシルーティングを処理し、LLM プロバイダー固有の癖を管理し、OpenTelemetry のトレースとメトリクスを自動で取得します。
Who it’s for
特定の AI フレームワークや言語に縛られずに、プロダクショングレードのインフラをデプロイしたいマルチエージェントシステムを構築する開発者向けです。
Highlights
- Declarative Orchestration: YAML の自然言語記述でリクエストを正しいエージェントへルーティングでき、カスタムルーティングコードを書く必要がありません。
- Model Agility: モデル名、エイリアス、または自動優先設定でルーティングできる統一された LLM API。
- Zero-Code Observability: 手動で計装することなく、エージェントシグナルと OTEL トレース/メトリクスを自動でエンドツーエンド取得。
- Filter Chains: ガードレール、モデレーションポリシー、メモリフックをエージェント全体に一貫して追加できる組み込みサポート。