SylphxAI/pdf-reader-mcp
Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.
解決的問題
PDF Reader MCP 解決了 AI 代理在閱讀 PDF 時產生幻覺或丟失上下文的問題。它不只是簡單地匯出純文本,而是提供包括表格、掃描文件 OCR 以及精確到頁碼的引用在內的結構化數據,確保代理能為答案提供可驗證的證據。
工作原理
它作為一個 Model Context Protocol (MCP) 伺服器運行,為 AI 代理提供三個主要工具:
read_pdf: 透過 OCR 和引用提取 markdown、表格和結構。search_pdf: 在進行深度閱讀之前,定位特定的頁面和片段匹配。pdf_evidence: 處理專注的證據操作,包括裁剪和渲染。
該系統使用原生 Rust 引擎以實現高性能,並使用輕量級的 Node.js 啟動器與 Claude Desktop、Cursor 或 VS Code 等 MCP 用戶端整合。
適用對象
此工具專為構建 AI 代理的開發者設計,這些代理需要處理複雜的文檔,如財務報告、研究論文和掃描版 PDF,在這些場景中,準確性和溯源至關重要。
亮點
- 結構化提取:將 PDF 轉換為具有 markdown、幾何結構和溯源資訊的「代理文件副本」。
- 高性能:使用原生 Rust 引擎,與之前的 TypeScript 版本相比,中位數延遲提高了高達 10 倍。
- 本地優先:在支援的平台(macOS、Linux、Windows)上本地處理文件。
- 低佔用:與傳統基於 JS 的 PDF 工具相比,顯著減少了安裝文件數量和依賴圖。