higress-group/higress

🤖 AI Gateway | AI Native API Gateway

解决的问题

Higress 是一个专为简化大型语言模型(LLM)API 和模型上下文协议(MCP)服务器管理而设计的 AI 原生 API 网关。它通过提供统一协议连接多个模型提供商,同时为 AI 驱动的应用程序提供生产级的流量管理、安全性和可观测性。

工作原理

基于 Istio 和 Envoy 构建,Higress 使用 Wasm(WebAssembly)插件机制扩展其功能。这使其能够作为 LLM API 和 MCP 服务器的统一入口点,提供一个抽象层,处理认证、限流和路由。它支持请求和响应体的真正流式处理,显著降低了使用 Server-Sent Events(SSE)等高带宽 AI 服务的内存开销。

适用人群

适用于需要安全、可扩展且可观测的网关来管理其模型提供商和工具调用服务的开发者和组织,特别是构建 AI 代理和 LLM 驱动应用的用户。

主要亮点

  • AI 网关功能:支持所有主流模型提供商的统一协议,多模型负载均衡,令牌速率限制,缓存。
  • MCP 服务器托管:通过插件托管 MCP 服务器,使 AI 代理能够调用工具和服务;包含一个将 OpenAPI 规范转换为远程 MCP 服务器的工具。
  • Wasm 插件系统:支持使用 Go、Rust 或 JS 编写的插件,实现内存安全、无流量损失的热更新网关逻辑。
  • 云原生:CNCF Sandbox 项目,兼容 Kubernetes Ingress 和 Gateway API 标准。
  • 生产级:在配置变更期间消除流量抖动,非常适合长期连接型 AI 业务。

相关

  • 项目
  • Dispatch
  • 项目
  • 项目
  • 项目