SylphxAI/pdf-reader-mcp

Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.

해결하는 문제

PDF Reader MCP는 AI 에이전트가 PDF를 읽을 때 환각 현상을 일으키거나 문맥을 놓치는 문제를 해결합니다. 단순한 텍스트 덤프 대신 표, 스캔된 문서용 OCR 및 정확한 페이지 단위 인용을 포함한 구조화된 데이터를 제공하여 에이전트가 답변에 대한 검증 가능한 근거를 가질 수 있도록 보장합니다.

작동 방식

이 서버는 Model Context Protocol (MCP) 서버로 작동하며 AI 에이전트에게 세 가지 주요 도구를 제공합니다:

  • read_pdf: OCR 및 인용을 사용하여 마크다운, 표 및 구조를 추출합니다.
  • search_pdf: 심층 읽기를 수행하기 전에 특정 페이지 및 스니펫 일치 항목을 찾습니다.
  • pdf_evidence: 크롭 및 렌더링을 포함한 집중적인 증거 작업을 처리합니다.

이 시스템은 고성능을 위해 네이티브 Rust 엔진을 사용하며, Claude Desktop, Cursor 또는 VS Code와 같은 MCP 클라이언트와 통합하기 위한 가벼운 Node.js 런처를 사용합니다.

대상 사용자

이 도구는 정확성과 출처가 중요한 재무 보고서, 연구 논문 및 스캔된 PDF와 같은 복잡한 문서를 처리해야 하는 AI 에이전트를 구축하는 개발자를 위해 설계되었습니다.

주요 특징

  • 구조화된 추출: PDF를 마크다운, 기하학적 구조 및 출처 정보를 포함하는 "에이전트 문서 트윈"으로 변환합니다.
  • 고성능: 네이티브 Rust 엔진을 사용하여 이전 TypeScript 버전보다 중앙값 지연 시간을 최대 10배까지 개선했습니다.
  • 로컬 우선: 지원되는 플랫폼(macOS, Linux, Windows)에서 문서를 로컬에서 처리합니다.
  • 낮은 점유율: 기존 JS 기반 PDF 도구와 비교하여 설치 파일 수와 종속성 그래프를 크게 줄였습니다.