looplj/axonhub
⚡️ Open-source AI Gateway — Use any SDK to call 100+ LLMs. Built-in failover, load balancing, cost control & end-to-end tracing.
AxonHub – 一體化 AI 開發平台
是什麼 – AxonHub 是用 Go 編寫的自托管網關,位於您的應用程式碼與任何大型語言模型(LLM)供應商之間。您可繼續使用相同的 SDK(例如 OpenAI 的 Python 客戶端),僅需變更設定檔即可在 OpenAI、Anthropic、Gemini 等不同模型供應商之間切換,無需修改程式碼。
核心功能
| 功能 | 你能獲得什麼 |
|---|---|
| 任意 SDK → 任意模型 | 使用 OpenAI、Anthropic 或其他 SDK,請求將自動轉換為所選供應商的 API 格式。無需修改程式碼。 |
| 完整請求追蹤 | 線程級日誌顯示每次呼叫的完整時間軸,讓除錯快速高效。 |
| 企業級 RBAC | 細粒度權限、使用配額與團隊間資料隔離。 |
| 智慧負載平衡與故障轉移 | <100ms 的路由決策;當某個供應商效能下降時,自動切換至最健康的通道。 |
| 即時成本追蹤 | 每個請求的 token 級成本分解(輸入、輸出、快取),並用於預算匯總。 |
| 多模態 API | 支援文字生成、影像生成、嵌入、重排序,以及(規劃中)即時聊天。 |
| 支援的供應商 | OpenAI、Anthropic、智譜(GLM)、Moonshot、DeepSeek、字節跳動 Doubao、Gemini、Jina AI、OpenRouter、AWS Bedrock(測試中)、Google Cloud(測試中)、NanoGPT 等。 |
運作方式 – AxonHub 提供一組模仿 OpenAI API 結構的 REST/GraphQL 端點。當請求到達時,AxonHub 執行以下步驟:
- 透過 AxonHub API 金鑰驗證呼叫者。
- 查詢目標供應商/通道(使用其自身的 API 金鑰設定)。
- 將請求內容轉換為供應商的原生格式。
- 發送請求,記錄延遲、token 使用量與成本,並以原始 OpenAI 風格的結構回傳響應。
快速開始(部署後)
from openai import OpenAI
client = OpenAI(
base_url="http://localhost:8090/v1", # AxonHub 位址
api_key="your-axonhub-api-key"
)
resp = client.chat.completions.create(
model="gpt-4o", # 任何已啟用的模型名稱
messages=[{"role": "user", "content": "Hello, AxonHub!"}]
)
print(resp.choices[0].message.content)
後續若將通道切換至 Claude、Gemini 或中文語言模型,相同的程式碼依然有效——僅需變更 AxonHub 設定即可。
典型使用情境
- 避免供應商鎖定 – 無需重寫客戶端程式碼即可在不同供應商之間測試或遷移。
- 成本優化 – 為低優先度任務路由低成本模型,同時為關鍵查詢保留高階模型。
- 可觀測性與治理 – 集中日誌、團隊級配額與成本儀表板,便於合規團隊管理。
- 多模態應用 – 在單一端點後整合文字、影像、嵌入與重排序 API。
部署 – 項目提供 Docker 鏡像(docker-ready 標籤),可在任何支援 Go 的主機上執行。README 提供 Render.com 上的示範實例連結,並附上 deploy-axonhub 技能以實現自動化部署。
文件與社群 – 完整的中英文文件、API 參考、追蹤、權限、負載平衡與成本追蹤指南均托管於倉儲與 DeepWiki 網站。專案採用 Apache-2.0/LGPL-3.0 雙重開源授權。
總結 – AxonHub 是一個實用且可投入生產的網關,抽象了 LLM 供應商之間的差異,為所有 AI 模型提供單一、可觀測的 API 表面。
相關
- 專案
- 專案
- 專案
- 專案
- 專案