workweave/router

Model router for agentic systems. Routes every prompt to the right model in <50ms. Cut costs 40-70% with just an endpoint change.

解決的問題

無需為每個任務手動選擇 LLM,而是提供單一 API 端點,自動將請求路由至最適合的模型。這消除了基於「直覺」的模型選擇方式,確保每個具體操作都根據性能數據而非直覺,選擇最佳模型。

工作原理

該路由器作為主要提供者(Anthropic、OpenAI、Gemini)以及 OpenAI 兼容端點(如 OpenRouter 支援的 DeepSeek、Llama 和 Mistral)的即插即用代理。它使用小型本地嵌入模型和基於 Avengers-Pro 研究的聚類評分器,即時評估每個上游 API 請求,並將請求路由至最佳模型。支援這些提供者之串流、工具和視覺功能。

適用對象

專為使用 AI 驅動的編碼工具(如 Claude Code、Cursor 或 Codex)的開發者,或正在建構自己應用的開發者設計,他們希望在不修改程式碼庫的情況下優化模型效能與成本,即使每次模型更新也不必變更程式碼。

主要亮點

  • 多提供者支援:相容 Anthropic、OpenAI、Gemini 以及透過 OpenRouter 使用的各種開源模型。
  • 基於動作的路由:按單一動作而非每回合對話進行路由。
  • 即插即用代理:只需將現有工具指向本地或託管端點,即可輕鬆整合。
  • 安全性:提供者金鑰本地儲存並靜態加密。
  • 可觀測性:內建 OTLP 追蹤,可與 Weave、Honeycomb 或 Datadog 等儀表板整合。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • Dispatch