llm-for-zotero
一个为 Zotero 设计的研究 agent 系统,允许用户通过带有可靠引用的 LLMs 与 PDF 进行对话、总结论文并管理其文献库。
nestia
一套针对 NestJS 的辅助库,提供高性能验证、自动 SDK 生成以及 AI 驱动的开发工具,用于构建类型化的 API 服务器。
kernel-memory
Kernel Memory 是一种多模态 AI 服务,用于高效的数据集索引和检索增强生成(RAG),提供数据摄取流水线工具并支持带引用的自然语言查询。
vearch
Vearch 是一款云原生分布式向量数据库,能够为 AI 应用实现嵌入向量的高效相似度搜索。
hamilton
一个轻量级的 Python 库,用于创建可移植且表达力强的数据转换 DAG,适用于构建机器学习工作流、ETL 流程和 RAG 系统。
seekdb
一个兼容 MySQL 的 AI 代理状态存储,提供高性能流式写入、混合向量/全文搜索以及写时复制沙盒,以实现安全探索。
autoflow
AutoFlow 是一个开源的 Graph RAG 知识库工具,能够通过内置网站爬虫和 TiDB Vector,让用户创建对话式搜索体验。
swirl-search
一个开源的联邦元搜索和 RAG 平台,实现跨企业数据源的统一搜索和 AI 摘要,无需移动或索引数据。
rag-web-ui
一个智能对话系统,允许用户通过检索增强生成(RAG)将自有文档知识库与 LLM 结合,构建定制化的问答服务。
fastembed
一个轻量、快速的 Python 库,使用 ONNX Runtime 生成文本、图像和多模态嵌入,避免了沉重的 PyTorch 依赖。
EvoAgentX
EvoAgentX 是一个开源框架,用于构建和自动演化基于 LLM 的代理和工作流,具备内置评估功能和丰富的工具库。
AnyCrawl
AnyCrawl 是一个高性能的网页爬取和抓取工具包,能够使用 LLM 从网站中提取结构化的 JSON 数据,使网页内容具备 LLM 可用性。
SimpleMem
一个统一的 LLM 代理记忆栈,使用语义无损压缩高效存储和检索文本及多模态记忆。
GenerativeAIExamples
一套参考实现和教程,帮助使用 NVIDIA 软件生态系统和 NIM 微服务构建生成式 AI 系统、RAG 流水线和代理工作流。
Lealone
Lealone 是一个高性能、自我进化的通用代理,通过自然语言和类 SQL 命令实现全栈应用和企业 AI 服务的开发。
holmesgpt
一个面向 SRE 的开源 AI 代理,能够在任何基础设施栈上自动化生产事故调查和根因分析。
ai
一个类型安全、与提供商无关的 TypeScript SDK,用于在多个 JS 框架中构建流式聊天、工具调用代理和多模态 AI 应用。
AdalFlow
AdalFlow 是一个类似 PyTorch 的库,用于构建并自动优化 LLM 工作流,包括聊天机器人、RAG 和代理,通过自动化文本梯度下降取代手动提示。
chonkie
一个轻量级、高性能的文本分块库,适用于 RAG 流水线,提供多样的拆分策略并可无缝集成向量数据库和嵌入提供商。
OpenMemory
为 AI 代理提供长期、多部门记忆和时间推理的认知记忆引擎,超越了简单的基于向量的 RAG。
llm-graph-builder
使用 LLM 和 LangChain 将来自各种来源的非结构化数据转换为存储在 Neo4j 中的结构化知识图谱的工具。
LLM-Engineers-Handbook
一个用于构建端到端 LLM 系统的生产就绪框架和代码库,涵盖了在 AWS 上的训练、RAG 和部署。
openagent
OpenAgent 是一个开源的个人 AI 助手平台,将 LLM、RAG 与自主代理循环整合到单个可自托管的二进制文件中,用于浏览器、Shell 和 Office 自动化。
ComfyUI-Copilot
一个用于 ComfyUI 的智能助手,自动化工作流生成、调试和参数调优,简化 AI 图像生成开发流程。
MineContext
MineContext 是一个主动式、具备上下文感知能力的 AI 伙伴,通过捕获屏幕活动和数字内容来自动生成摘要、待办事项列表和见解。
PixelRAG
PixelRAG 是一种视觉 RAG 系统,它将文档渲染为截图而不是解析为文本,使 AI 能够检索和推理表格、图表等视觉元素。
helix-db
HelixDB 是一个使用 Rust 构建的图-向量数据库,它将图、向量、关系型和文档数据整合到一个单一平台中,用于 AI 记忆和知识图谱。
honcho
Honcho 是为有状态的 AI agent 提供的内存基础设施,通过后台推理和以 peer 为中心的表示,允许它们对人员和项目保持持久且不断演进的理解。
UltraRAG
基于模型上下文协议(MCP)的轻量级 RAG 开发框架,实现了复杂工作流的低代码编排,并通过可视化 IDE 支持快速原型开发。
trafilatura
一个用于发现并提取网页干净、结构化文本和元数据的 Python 包和命令行工具,去除 HTML 噪音以创建高质量数据集。
airweave
一个面向 AI 代理和 RAG 系统的开源上下文检索层,将 50+ 集成的数据同步到统一、面向 LLM 的搜索接口。
vespa
Vespa 是一个高性能平台,用于搜索、推荐和个性化,能够在规模化的情况下使用向量、张量和文本进行实时推断和数据组织。
Upsonic
一个用于构建自主和传统 AI 代理的 Python 框架,具备安全的工作区执行、自定义工具集成以及统一的 OCR 管道。
paper-qa
PaperQA2 是一个面向科学文献的代理式 RAG 系统,能够从 PDF 等文档格式中提供高精度、带有文中引用的有依据答案。
garden-skills
为 AI 编程代理(Claude Code、Cursor、Codex)精选的一系列生产就绪的技能,用于在 Web 设计、视频制作和图像生成方面执行专业任务。
claude-context
一个 MCP 插件,为 AI 编程代理添加了语义代码搜索功能,允许它们使用向量数据库从大型代码库中高效地检索相关的代码片段。
turbovec
基于 Rust 的向量索引,提供 Python 绑定,实现 Google 的 TurboQuant 算法,为 RAG 应用提供极致内存压缩和快速 SIMD 加速的向量搜索。
zvec
Zvec 是一个开源的进程内向量数据库,可直接嵌入应用程序中,提供低延迟的相似性搜索和混合检索。
coze-studio
Coze Studio 是一个开源的低代码可视化开发平台,用于创建、调试和部署 AI 代理、工作流和 AI 应用。
DeepTutor
DeepTutor 是一个原生于智能体的个性化辅导工作区,它将辅导、研究和掌握练习集成到一个具有共享记忆和多引擎 RAG 的单一系统中。
kotaemon
一个开源、可定制的 RAG UI,用于与文档聊天,具备混合检索、多模态解析和高级引用功能。
claude-mem
一种针对 Claude Code 及其他 AI CLI 的持久记忆压缩系统,能够在会话之间保留项目上下文和工具观察。
opendataloader-pdf
一款开源的 PDF 解析器和可访问性工具,可为 AI 流水线提取结构化数据 (Markdown, JSON),并自动创建用于符合可访问性合规性的 Tagged PDFs。
ragflow
RAGFlow 是一个开源的 RAG 引擎,它将深度文档理解与智能体能力相结合,从而能够从复杂的非结构化数据中创建基于事实的、生产级的 AI 系统。
PaddleOCR
全球领先的 OCR 工具包和文档 AI 引擎,可将 PDF 和图像转换为结构化的 JSON 或 Markdown 数据,用于 LLM-ready 应用。
superglue
一款 AI 驱动的工具构建器,允许用户使用自然语言创建生产级集成和工具,具备针对 API 变更的自愈能力。
agents-best-practices
一种与提供商无关的 Agent Skill,为设计严谨、生产级安全的 agent harness 提供蓝图和最佳实践,以管理工具执行、权限和可观测性。
llama_deploy
LlamaDeploy 是用于部署和提供 AI 工作流的工具,但现已弃用,推荐使用 **llama-agents**。
ui
一个基于 shadcn/ui 构建的 React 组件库,为构建音频和 AI agent 应用提供预构建的 UI 元素,如波形图和 orbs。
shippie
Shippie 是一个可扩展的代码审查代理,在 Pull Request 过程中分析差异并遍历代码库,以识别 bug、密钥泄露和低效代码等问题。