SylphxAI/citra
Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.
解決する課題
Citraは、PDFを読む際にAIエージェントが誤った情報を生成するのを防ぐため、単なるテキストではなく「証拠」を提供します。エージェントがページ番号を勝手に生成したり、複雑な表を無意味なテキストに変換したり、スキャンされたドキュメントを読み取れなかったりする問題を、正確な幾何学情報、ページ単位の引用、OCRパスを含む構造化データを返すことで解決します。
動作方法
Rustで書かれたローカルファーストPDFエンジンとして動作し、軽量なNode.jsランチャーレイヤーを備えています。Model Context Protocol (MCP) サーバー、CLI、またはSDKとしてデプロイ可能です。エージェント向けに以下の3つの主要ツールを提供します:
read_pdf: 引用付きのMarkdown、表、構造、OCRを抽出します。search_pdf: 深い読み取りを行う前に、ページおよびスニペットの一致を検索します。pdf_evidence: ビジュアルなクロップ、レンダリング、および焦点を当てた証拠操作を処理します。
対象ユーザー
金融報告書、研究論文、スキャンされた文書など、正確性と検証可能な引用が重要な高リスク文書を処理するAIエージェントを開発する開発者向けに設計されています。
特徴
- ゼロ設定セットアップ:DockerやAPIキーなしで、
npx -y @sylphx/citraで即座に起動可能。 - ローカルファーストのプライバシー:クラウドのビジュアルAPIを必要とせず、PDFはローカルマシン上で処理されます。
- 高忠実度の抽出:バウンディングボックスを保持して、表の行、列、セルを正確に再現します。
- MCP統合:Claude Desktop、Cursor、VS Code、およびその他のMCP互換ホストに対応しています。
- 高パフォーマンス:TypeScriptベースのPDFツールと比較して、大幅に低遅延を実現するネイティブRustエンジンを使用しています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト