SylphxAI/citra

Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.

解决的问题

Citra 通过提供"证据"而非仅提供纯文本,防止 AI 代理在阅读 PDF 时产生幻觉。它通过返回包含精确几何信息、页面级引用和 OCR 路径的结构化数据,解决了代理虚构页码、将复杂表格扁平化为无用文本,或无法读取扫描文档的问题。

工作原理

Citra 是一个用 Rust 编写的本地优先 PDF 引擎,配有轻量级 Node.js 启动器。它可以作为 Model Context Protocol (MCP) 服务器、CLI 或 SDK 部署。系统为代理提供三种主要工具:

  • read_pdf:提取带引用的 Markdown、表格、结构和 OCR。
  • search_pdf:在深度阅读前定位页面和片段匹配。
  • pdf_evidence:处理视觉裁剪、渲染和聚焦的证据操作。

适用人群

专为需要处理高风险文档(如财务报告、研究论文和扫描文档)的 AI 代理开发者设计,其中准确性和可验证的引用至关重要。

亮点

  • 零配置启动:无需 Docker 或 API 密钥,直接通过 npx -y @sylphx/citra 即可启动。
  • 本地优先隐私:PDF 在本地机器上处理,无需依赖云视觉 API。
  • 高保真提取:保留表格的行、列和单元格及其边界框。
  • MCP 集成:原生支持 Claude Desktop、Cursor、VS Code 及其他 MCP 兼容主机。
  • 高性能:使用原生 Rust 引擎,相比基于 TypeScript 的 PDF 工具显著降低延迟。

相关

  • 项目
  • 项目
  • 项目
  • 项目