xerj-org/xerj
XERJ is the new way for AI to search data. Its autoindex capability activates agents to know your data without the token waste of grep and sed. One command indexes code, docs, logs and PDFs for search, RAG, security audits and agent memory, using 40x fewer tokens than grep. Elasticsearch compatible, so existing clients just work.
何を解決するか
XERJ は、コードエージェントが1つずつファイル全体を読み込むことでトークンを無駄に消費することを防ぐために設計されたローカルAI検索エンジンです。エージェントは必要最小限のコード断片やドキュメントのみを取得できるため、入力および出力のトークンコストを大幅に削減しつつ、コード作成タスクの解決率を維持できます。
動作方法
XERJ は、手動のスキーマ設定なしに、コード、ドキュメント、ログ、PDF、およびその他の構造化データ(CSV、JSON、SQLite)を含むフォルダを自動的にインデックス化します。ソースコードのインデックス化には tree-sitter を使用し、単なる平文ではなく、シンボルや関数をインデックス化することでASTに配慮した検索を実現します。このシステムは、Elasticsearch API と互換性のあるREST APIを提供しており、既存のクライアントやダッシュボードとシームレスに統合可能です。また、Model Context Protocol (MCP) をサポートしており、AIアシスタントにツールとして直接統合できます。
対象ユーザー
プライベートまたはニッチなコードベースでトークン使用量を削減し、エージェントの精度を向上させたいAIコードエージェント(例:Claude Code や Cursor)を使用する開発者に特に適しています。また、セキュリティ監査担当者、ログ分析担当者、RAGアプリケーションを開発する開発者にとっても、軽量でシングルバイナリの検索バックエンドとして最適です。
主な特徴
- 参照コード:類似したオープンソースプロジェクトをインデックス化し、新しいコードを書く前に既存の解決策を見つけることを可能にします。
- Elasticsearch互換:既存のツールとのシームレスな統合を実現するため、Elasticsearch REST API を実装しています。
- ゼロ構成の自動インデックス化:ファイルタイプを自動検出し、任意のフォルダに対してインデックスを作成します。
- MCPネイティブ:Model Context Protocol に対応しており、エージェントとの統合が簡単です。
- コード認識検索:tree-sitter を使用してシンボルと行番号をインデックス化し、正確なコード取得を実現します。
- ハイブリッド検索:1回のクエリで全文検索、ベクトル検索(kNN)、ハイブリッド検索をサポートします。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト