SylphxAI/pdf-reader-mcp

Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.

解決する課題

PDF Reader MCPは、AIエージェントがPDFを読み取る際にハルシネーション(もっともらしい嘘)を起こしたり、文脈を見失ったりする問題を解決します。単なるプレーンテキストの出力ではなく、表、スキャンされたドキュメント用のOCR、および正確なページレベルの引用を含む構造化データを提供し、エージェントが回答の根拠を検証できるようにします。

仕組み

このサーバーはModel Context Protocol (MCP) サーバーとして動作し、AIエージェントに3つの主要なツールを提供します。

  • read_pdf: OCRと引用を用いて、markdown、表、および構造を抽出します。
  • search_pdf: 詳細な読み取りを行う前に、特定のページやスニペットの照合を行います。
  • pdf_evidence: 切り抜きやレンダリングを含む、フォーカスされたエビデンス操作を処理します。

システムには、高いパフォーマンスを実現するネイティブのRustエンジンと、Claude Desktop、Cursor、VS CodeなどのMCPクライアントと統合するための軽量なNode.jsランチャーが採用されています。

対象ユーザー

このツールは、財務報告書、研究論文、スキャンされたPDFなど、正確性と出典の明示が極めて重要となる複雑なドキュメントを処理する必要があるAIエージェントを開発している開発者向けに設計されています。

ハイライト

  • 構造化抽出: PDFをmarkdown、ジオメトリ、および出典情報を備えた「エージェント用ドキュメント・ツイン」に変換します。
  • 高いパフォーマンス: ネイティブのRustエンジンを使用しており、従来のTypeScript版と比較して中央値のレイテンシを最大10倍改善しています。
  • ローカルファースト: サポートされているプラットフォーム(macOS、Linux、Windows)上でドキュメントをローカルに処理します。
  • 低フットプリント: 従来のJSベースのPDFツールと比較して、インストールされるファイル数と依存関係グラフを大幅に削減しています。