SylphxAI/citra

Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.

解決する課題

Citraは、PDFを読む際にAIエージェントが誤った情報を生成するのを防ぐため、単なるテキストではなく「証拠」を提供します。エージェントがページ番号を勝手に生成したり、複雑な表を無意味なテキストに変換したり、スキャンされたドキュメントを読み取れなかったりする問題を、正確な幾何学情報、ページ単位の引用、OCRパスを含む構造化データを返すことで解決します。

動作方法

Rustで書かれたローカルファーストPDFエンジンとして動作し、軽量なNode.jsランチャーレイヤーを備えています。Model Context Protocol (MCP) サーバー、CLI、またはSDKとしてデプロイ可能です。エージェント向けに以下の3つの主要ツールを提供します:

  • read_pdf: 引用付きのMarkdown、表、構造、OCRを抽出します。
  • search_pdf: 深い読み取りを行う前に、ページおよびスニペットの一致を検索します。
  • pdf_evidence: ビジュアルなクロップ、レンダリング、および焦点を当てた証拠操作を処理します。

対象ユーザー

金融報告書、研究論文、スキャンされた文書など、正確性と検証可能な引用が重要な高リスク文書を処理するAIエージェントを開発する開発者向けに設計されています。

特徴

  • ゼロ設定セットアップ:DockerやAPIキーなしで、npx -y @sylphx/citra で即座に起動可能。
  • ローカルファーストのプライバシー:クラウドのビジュアルAPIを必要とせず、PDFはローカルマシン上で処理されます。
  • 高忠実度の抽出:バウンディングボックスを保持して、表の行、列、セルを正確に再現します。
  • MCP統合:Claude Desktop、Cursor、VS Code、およびその他のMCP互換ホストに対応しています。
  • 高パフォーマンス:TypeScriptベースのPDFツールと比較して、大幅に低遅延を実現するネイティブRustエンジンを使用しています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト