SylphxAI/citra
Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.
解決的問題
Citra 透過提供「證據」而非僅僅是純文字,防止 AI 代理在閱讀 PDF 時產生幻覺。它透過回傳包含精確幾何資訊、頁面級引用與 OCR 路徑的結構化資料,解決代理虛構頁碼、將複雜表格扁平化為無用文字,或無法讀取掃描文件的問題。
如何運作
Citra 是以 Rust 編寫的本地優先 PDF 引擎,搭配輕量級 Node.js 啟動器。可作為 Model Context Protocol (MCP) 伺服器、CLI 或 SDK 部署。系統為代理提供三種主要工具:
read_pdf:提取帶引用的 Markdown、表格、結構與 OCR。search_pdf:在深度閱讀前定位頁面與片段匹配。pdf_evidence:處理視覺裁剪、渲染與聚焦的證據操作。
適用對象
專為需要處理高風險文件(如財務報告、研究論文與掃描文件)的 AI 代理開發者設計,其中準確性與可驗證的引用至關重要。
特色
- 零設定啟動:無需 Docker 或 API 金鑰,直接透過
npx -y @sylphx/citra即可啟動。 - 本地優先隱私:PDF 在本地機器上處理,無需依賴雲端視覺 API。
- 高保真提取:保留表格的行、列與單元格及其邊界框。
- MCP 整合:原生支援 Claude Desktop、Cursor、VS Code 及其他 MCP 相容主機。
- 高效率:使用原生 Rust 引擎,相比基於 TypeScript 的 PDF 工具顯著降低延遲。
相關
- 專案
- 專案
- 專案
- 專案