SylphxAI/citra
Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.
解决的问题
Citra 通过提供"证据"而非仅提供纯文本,防止 AI 代理在阅读 PDF 时产生幻觉。它通过返回包含精确几何信息、页面级引用和 OCR 路径的结构化数据,解决了代理虚构页码、将复杂表格扁平化为无用文本,或无法读取扫描文档的问题。
工作原理
Citra 是一个用 Rust 编写的本地优先 PDF 引擎,配有轻量级 Node.js 启动器。它可以作为 Model Context Protocol (MCP) 服务器、CLI 或 SDK 部署。系统为代理提供三种主要工具:
read_pdf:提取带引用的 Markdown、表格、结构和 OCR。search_pdf:在深度阅读前定位页面和片段匹配。pdf_evidence:处理视觉裁剪、渲染和聚焦的证据操作。
适用人群
专为需要处理高风险文档(如财务报告、研究论文和扫描文档)的 AI 代理开发者设计,其中准确性和可验证的引用至关重要。
亮点
- 零配置启动:无需 Docker 或 API 密钥,直接通过
npx -y @sylphx/citra即可启动。 - 本地优先隐私:PDF 在本地机器上处理,无需依赖云视觉 API。
- 高保真提取:保留表格的行、列和单元格及其边界框。
- MCP 集成:原生支持 Claude Desktop、Cursor、VS Code 及其他 MCP 兼容主机。
- 高性能:使用原生 Rust 引擎,相比基于 TypeScript 的 PDF 工具显著降低延迟。
相关
- 项目
- 项目
- 项目
- 项目