SylphxAI/pdf-reader-mcp
Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.
解决的问题
PDF Reader MCP 解决了 AI 智能体在阅读 PDF 时产生幻觉或丢失上下文的问题。它不只是简单地导出纯文本,而是提供包括表格、扫描文档的 OCR 以及精确到页码的引用在内的结构化数据,确保智能体能够为答案提供可验证的证据。
工作原理
它作为一个 Model Context Protocol (MCP) 服务器运行,为 AI 智能体提供三个主要工具:
read_pdf: 通过 OCR 和引用提取 markdown、表格和结构。search_pdf: 在进行深度阅读之前,定位特定的页面和片段匹配。pdf_evidence: 处理专注的证据操作,包括裁剪和渲染。
该系统使用原生 Rust 引擎以实现高性能,并使用轻量级的 Node.js 启动器与 Claude Desktop、Cursor 或 VS Code 等 MCP 客户端集成。
适用对象
该工具专为构建 AI 智能体的开发者设计,这些智能体需要处理复杂的文档,如财务报告、研究论文和扫描版 PDF,在这些场景中,准确性和溯源至关重要。
亮点
- 结构化提取:将 PDF 转换为具有 markdown、几何结构和溯源信息的“智能体文档副本”。
- 高性能:使用原生 Rust 引擎,与之前的 TypeScript 版本相比,中位数延迟提高了高达 10 倍。
- 本地优先:在支持的平台(macOS、Linux、Windows)上本地处理文档。
- 低占用:与传统的基于 JS 的 PDF 工具相比,显著减少了安装文件数量和依赖图。