SylphxAI/citra

Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.

解決的問題

Citra 透過提供「證據」而非僅僅是純文字,防止 AI 代理在閱讀 PDF 時產生幻覺。它透過回傳包含精確幾何資訊、頁面級引用與 OCR 路徑的結構化資料,解決代理虛構頁碼、將複雜表格扁平化為無用文字,或無法讀取掃描文件的問題。

如何運作

Citra 是以 Rust 編寫的本地優先 PDF 引擎,搭配輕量級 Node.js 啟動器。可作為 Model Context Protocol (MCP) 伺服器、CLI 或 SDK 部署。系統為代理提供三種主要工具:

  • read_pdf:提取帶引用的 Markdown、表格、結構與 OCR。
  • search_pdf:在深度閱讀前定位頁面與片段匹配。
  • pdf_evidence:處理視覺裁剪、渲染與聚焦的證據操作。

適用對象

專為需要處理高風險文件(如財務報告、研究論文與掃描文件)的 AI 代理開發者設計,其中準確性與可驗證的引用至關重要。

特色

  • 零設定啟動:無需 Docker 或 API 金鑰,直接透過 npx -y @sylphx/citra 即可啟動。
  • 本地優先隱私:PDF 在本地機器上處理,無需依賴雲端視覺 API。
  • 高保真提取:保留表格的行、列與單元格及其邊界框。
  • MCP 整合:原生支援 Claude Desktop、Cursor、VS Code 及其他 MCP 相容主機。
  • 高效率:使用原生 Rust 引擎,相比基於 TypeScript 的 PDF 工具顯著降低延遲。

相關

  • 專案
  • 專案
  • 專案
  • 專案