xerj-org/xerj
XERJ is the new way for AI to search data. Its autoindex capability activates agents to know your data without the token waste of grep and sed. One command indexes code, docs, logs and PDFs for search, RAG, security audits and agent memory, using 40x fewer tokens than grep. Elasticsearch compatible, so existing clients just work.
解决的问题
XERJ 是一个本地 AI 搜索引擎,旨在防止代码代理因逐行读取整个文件而浪费令牌。它允许代理仅检索所需的确切代码片段或文档,显著降低输入和输出令牌成本,同时保持高代码任务解决率。
工作原理
XERJ 无需手动设置模式,即可自动索引包含代码、文档、日志、PDF 以及其他结构化数据(CSV、JSON、SQLite)的文件夹。它使用 tree-sitter 进行 AST 意识的代码索引,确保索引的是符号和函数,而不仅仅是扁平文本。该系统提供与 Elasticsearch API 兼容的 REST API,可与现有客户端和仪表板无缝集成。它还支持 Model Context Protocol (MCP),可直接作为工具集成到 AI 助手中。
适用人群
主要面向使用 AI 代码代理(如 Claude Code 或 Cursor)的开发者,他们希望减少令牌使用量,并在私有或小众代码库中提高代理准确性。也适用于安全审计员、日志分析师以及构建 RAG 应用的开发者,他们需要一个轻量级、单二进制文件的搜索后端。
主要亮点
- 参考代码:使代理能够索引类似的开源项目,在编写新代码前找到现有解决方案。
- Elasticsearch 兼容:实现 Elasticsearch REST API,可与现有工具无缝集成。
- 零配置自动索引:自动检测文件类型,并为任意文件夹创建索引。
- MCP 原生支持:内置对 Model Context Protocol 的支持,便于代理集成。
- 代码感知检索:使用 tree-sitter 索引符号和行号,实现精确的代码检索。
- 混合搜索:单次查询支持全文、向量(kNN)和混合搜索。
相关
- 项目
- 项目
- 项目
- 项目
- 项目