901

llm-for-zotero

一个为 Zotero 设计的研究 agent 系统,允许用户通过带有可靠引用的 LLMs 与 PDF 进行对话、总结论文并管理其文献库。

902

nestia

一套针对 NestJS 的辅助库,提供高性能验证、自动 SDK 生成以及 AI 驱动的开发工具,用于构建类型化的 API 服务器。

903

kernel-memory

Kernel Memory 是一种多模态 AI 服务,用于高效的数据集索引和检索增强生成(RAG),提供数据摄取流水线工具并支持带引用的自然语言查询。

904

vearch

Vearch 是一款云原生分布式向量数据库,能够为 AI 应用实现嵌入向量的高效相似度搜索。

905

hamilton

一个轻量级的 Python 库,用于创建可移植且表达力强的数据转换 DAG,适用于构建机器学习工作流、ETL 流程和 RAG 系统。

906

seekdb

一个兼容 MySQL 的 AI 代理状态存储,提供高性能流式写入、混合向量/全文搜索以及写时复制沙盒,以实现安全探索。

907

autoflow

AutoFlow 是一个开源的 Graph RAG 知识库工具,能够通过内置网站爬虫和 TiDB Vector,让用户创建对话式搜索体验。

908

swirl-search

一个开源的联邦元搜索和 RAG 平台,实现跨企业数据源的统一搜索和 AI 摘要,无需移动或索引数据。

909

rag-web-ui

一个智能对话系统,允许用户通过检索增强生成(RAG)将自有文档知识库与 LLM 结合,构建定制化的问答服务。

910

fastembed

一个轻量、快速的 Python 库,使用 ONNX Runtime 生成文本、图像和多模态嵌入,避免了沉重的 PyTorch 依赖。

911

EvoAgentX

EvoAgentX 是一个开源框架,用于构建和自动演化基于 LLM 的代理和工作流,具备内置评估功能和丰富的工具库。

912

AnyCrawl

AnyCrawl 是一个高性能的网页爬取和抓取工具包,能够使用 LLM 从网站中提取结构化的 JSON 数据,使网页内容具备 LLM 可用性。

913

SimpleMem

一个统一的 LLM 代理记忆栈,使用语义无损压缩高效存储和检索文本及多模态记忆。

914

GenerativeAIExamples

一套参考实现和教程,帮助使用 NVIDIA 软件生态系统和 NIM 微服务构建生成式 AI 系统、RAG 流水线和代理工作流。

915

Lealone

Lealone 是一个高性能、自我进化的通用代理,通过自然语言和类 SQL 命令实现全栈应用和企业 AI 服务的开发。

916

holmesgpt

一个面向 SRE 的开源 AI 代理,能够在任何基础设施栈上自动化生产事故调查和根因分析。

917

ai

一个类型安全、与提供商无关的 TypeScript SDK,用于在多个 JS 框架中构建流式聊天、工具调用代理和多模态 AI 应用。

918

AdalFlow

AdalFlow 是一个类似 PyTorch 的库,用于构建并自动优化 LLM 工作流,包括聊天机器人、RAG 和代理,通过自动化文本梯度下降取代手动提示。

919

chonkie

一个轻量级、高性能的文本分块库,适用于 RAG 流水线,提供多样的拆分策略并可无缝集成向量数据库和嵌入提供商。

920

OpenMemory

为 AI 代理提供长期、多部门记忆和时间推理的认知记忆引擎,超越了简单的基于向量的 RAG。

921

llm-graph-builder

使用 LLM 和 LangChain 将来自各种来源的非结构化数据转换为存储在 Neo4j 中的结构化知识图谱的工具。

922

LLM-Engineers-Handbook

一个用于构建端到端 LLM 系统的生产就绪框架和代码库,涵盖了在 AWS 上的训练、RAG 和部署。

923

openagent

OpenAgent 是一个开源的个人 AI 助手平台,将 LLM、RAG 与自主代理循环整合到单个可自托管的二进制文件中,用于浏览器、Shell 和 Office 自动化。

924

ComfyUI-Copilot

一个用于 ComfyUI 的智能助手,自动化工作流生成、调试和参数调优,简化 AI 图像生成开发流程。

925

MineContext

MineContext 是一个主动式、具备上下文感知能力的 AI 伙伴,通过捕获屏幕活动和数字内容来自动生成摘要、待办事项列表和见解。

926

PixelRAG

PixelRAG 是一种视觉 RAG 系统,它将文档渲染为截图而不是解析为文本,使 AI 能够检索和推理表格、图表等视觉元素。

927

helix-db

HelixDB 是一个使用 Rust 构建的图-向量数据库,它将图、向量、关系型和文档数据整合到一个单一平台中,用于 AI 记忆和知识图谱。

928

honcho

Honcho 是为有状态的 AI agent 提供的内存基础设施,通过后台推理和以 peer 为中心的表示,允许它们对人员和项目保持持久且不断演进的理解。

929

UltraRAG

基于模型上下文协议(MCP)的轻量级 RAG 开发框架,实现了复杂工作流的低代码编排,并通过可视化 IDE 支持快速原型开发。

930

trafilatura

一个用于发现并提取网页干净、结构化文本和元数据的 Python 包和命令行工具,去除 HTML 噪音以创建高质量数据集。

931

airweave

一个面向 AI 代理和 RAG 系统的开源上下文检索层,将 50+ 集成的数据同步到统一、面向 LLM 的搜索接口。

932

vespa

Vespa 是一个高性能平台,用于搜索、推荐和个性化,能够在规模化的情况下使用向量、张量和文本进行实时推断和数据组织。

933

Upsonic

一个用于构建自主和传统 AI 代理的 Python 框架,具备安全的工作区执行、自定义工具集成以及统一的 OCR 管道。

934

paper-qa

PaperQA2 是一个面向科学文献的代理式 RAG 系统,能够从 PDF 等文档格式中提供高精度、带有文中引用的有依据答案。

935

garden-skills

为 AI 编程代理(Claude Code、Cursor、Codex)精选的一系列生产就绪的技能,用于在 Web 设计、视频制作和图像生成方面执行专业任务。

936

claude-context

一个 MCP 插件,为 AI 编程代理添加了语义代码搜索功能,允许它们使用向量数据库从大型代码库中高效地检索相关的代码片段。

937

turbovec

基于 Rust 的向量索引,提供 Python 绑定,实现 Google 的 TurboQuant 算法,为 RAG 应用提供极致内存压缩和快速 SIMD 加速的向量搜索。

938

zvec

Zvec 是一个开源的进程内向量数据库,可直接嵌入应用程序中,提供低延迟的相似性搜索和混合检索。

939

coze-studio

Coze Studio 是一个开源的低代码可视化开发平台,用于创建、调试和部署 AI 代理、工作流和 AI 应用。

940

DeepTutor

DeepTutor 是一个原生于智能体的个性化辅导工作区,它将辅导、研究和掌握练习集成到一个具有共享记忆和多引擎 RAG 的单一系统中。

941

kotaemon

一个开源、可定制的 RAG UI,用于与文档聊天,具备混合检索、多模态解析和高级引用功能。

942

claude-mem

一种针对 Claude Code 及其他 AI CLI 的持久记忆压缩系统,能够在会话之间保留项目上下文和工具观察。

943

opendataloader-pdf

一款开源的 PDF 解析器和可访问性工具,可为 AI 流水线提取结构化数据 (Markdown, JSON),并自动创建用于符合可访问性合规性的 Tagged PDFs。

944

ragflow

RAGFlow 是一个开源的 RAG 引擎,它将深度文档理解与智能体能力相结合,从而能够从复杂的非结构化数据中创建基于事实的、生产级的 AI 系统。

945

PaddleOCR

全球领先的 OCR 工具包和文档 AI 引擎,可将 PDF 和图像转换为结构化的 JSON 或 Markdown 数据,用于 LLM-ready 应用。

946

superglue

一款 AI 驱动的工具构建器,允许用户使用自然语言创建生产级集成和工具,具备针对 API 变更的自愈能力。

947

agents-best-practices

一种与提供商无关的 Agent Skill,为设计严谨、生产级安全的 agent harness 提供蓝图和最佳实践,以管理工具执行、权限和可观测性。

948

llama_deploy

LlamaDeploy 是用于部署和提供 AI 工作流的工具,但现已弃用,推荐使用 **llama-agents**。

949

ui

一个基于 shadcn/ui 构建的 React 组件库,为构建音频和 AI agent 应用提供预构建的 UI 元素,如波形图和 orbs。

950

shippie

Shippie 是一个可扩展的代码审查代理,在 Pull Request 过程中分析差异并遍历代码库,以识别 bug、密钥泄露和低效代码等问题。