GitHamza0206/simba

OpenSource Production ready Customer service with built in Evals and monitoring

它解决了什么问题

Simba 提供高效率、开源的客服助理,消除许多 AI 解决方案的“黑箱”特性。它通过让团队完全控制数据、RAG 流程,以及通过内置评估指标来衡量 AI 质量,解决了通用 AI 响应和供应商锁定的问题。

工作原理

Simba 使用 Retrieval‑Augmented Generation(RAG)架构。它由一个 FastAPI 后端组成,将网站(通过 npm 聊天小部件)连接到向量存储(如 Qdrant 或 FAISS)和大型语言模型(OpenAI 或本地模型)。文档的异步摄取使用 Celery 与 Redis。用户可以自定义管道的每个部分,包括嵌入模型、切块策略和重新排序器。

适用对象

它面向希望在网站上部署自托管、可定制的 AI 客服助理,并需要使用特定检索和生成指标来衡量性能的团队。

亮点

  • 以评估为先的设计:内置检索准确率、生成质量和延迟的追踪。
  • 易于集成:包含即插即用的 npm 包(simba-chat-widget),可快速在网站上部署。
  • 高度可定制:支持替换 LLM、向量存储、嵌入模型和重新排序器。
  • 生产就绪:具备流式响应、异步处理以及用于文档和对话的管理仪表板。