SylphxAI/pdf-reader-mcp

Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.

解决的问题

PDF Reader MCP 解决了 AI 智能体在阅读 PDF 时产生幻觉或丢失上下文的问题。它不只是简单地导出纯文本,而是提供包括表格、扫描文档的 OCR 以及精确到页码的引用在内的结构化数据,确保智能体能够为答案提供可验证的证据。

工作原理

它作为一个 Model Context Protocol (MCP) 服务器运行,为 AI 智能体提供三个主要工具:

  • read_pdf: 通过 OCR 和引用提取 markdown、表格和结构。
  • search_pdf: 在进行深度阅读之前,定位特定的页面和片段匹配。
  • pdf_evidence: 处理专注的证据操作,包括裁剪和渲染。

该系统使用原生 Rust 引擎以实现高性能,并使用轻量级的 Node.js 启动器与 Claude Desktop、Cursor 或 VS Code 等 MCP 客户端集成。

适用对象

该工具专为构建 AI 智能体的开发者设计,这些智能体需要处理复杂的文档,如财务报告、研究论文和扫描版 PDF,在这些场景中,准确性和溯源至关重要。

亮点

  • 结构化提取:将 PDF 转换为具有 markdown、几何结构和溯源信息的“智能体文档副本”。
  • 高性能:使用原生 Rust 引擎,与之前的 TypeScript 版本相比,中位数延迟提高了高达 10 倍。
  • 本地优先:在支持的平台(macOS、Linux、Windows)上本地处理文档。
  • 低占用:与传统的基于 JS 的 PDF 工具相比,显著减少了安装文件数量和依赖图。