BerriAI/litellm
The fastest, litest AI Gateway. Rust core with Python SDK. Call 100+ LLM APIs in OpenAI (or native) format with cost tracking, guardrails, load balancing, and logging [Bedrock, Azure, OpenAI, Anthropic, OpenAI, VertexAI, vLLM, Nvidia NIM]
解决的问题
LiteLLM 简化了管理多个 LLM 提供商的复杂性。无需为每个模型处理不同的 SDK、认证模式和请求格式,它提供了一个统一的接口,使用 OpenAI 格式调用超过 100 个 LLM 提供商。
工作原理
LiteLLM 可以通过两种方式实现:
- Python SDK:一个可直接集成到代码中的库,允许您使用一致的语法调用各种模型(例如 GPT-4o、Claude Sonnet)。
- AI 网关(代理服务器):一个可自托管的集中式服务。它作为代理,将请求转换为特定提供方所需的格式,提供企业级功能,如虚拟密钥、支出跟踪、负载均衡和防护机制。
此外,它还支持 A2A 协议以调用代理,并提供 MCP(模型上下文协议)桥接,将 MCP 服务器连接到任何 LLM。
适用人群
使用多个 LLM 提供商,希望避免供应商锁定、在更换模型时减少代码重写,并集中管理团队 LLM 调用的开发者和组织。
主要亮点
- 统一 API:一个接口支持 100 多个 LLM,无需使用特定供应商的 SDK。
- OpenAI 兼容性:即插即用的兼容性,允许在不重写代码的情况下更换提供方。
- 企业级网关:包含虚拟密钥、支出跟踪和管理仪表板。
- 高性能:在 1k RPS 下达到 8ms 的 P95 延迟。
- 支持代理与工具:支持 A2A 代理和 MCP 工具集成。
相关
- 项目
- 项目
- 项目
- 项目