SylphxAI/citra
Give your AI agent eyes for PDFs — structured text, tables, OCR, visual evidence, and page-level citations via MCP. Native Rust, local-first.
해결하는 문제
Citra는 AI 에이전트가 PDF를 읽을 때 착각을 방지하기 위해 단순한 텍스트가 아닌 "증거"를 제공함으로써 문제를 해결합니다. 에이전트가 페이지 번호를 창조하거나, 복잡한 표를 사용할 수 없는 텍스트로 평면화하거나, 스캔된 문서를 읽지 못하는 문제를 정확한 기하학적 정보, 페이지 단위 인용, OCR 경로를 포함한 구조화된 데이터를 반환함으로써 해결합니다.
작동 방식
Rust로 작성된 로컬 우선 PDF 엔진으로, 가벼운 Node.js 런처를 갖추고 있습니다. Model Context Protocol (MCP) 서버, CLI, 또는 SDK로 배포할 수 있습니다. 시스템은 에이전트를 위한 세 가지 주요 도구를 제공합니다:
read_pdf: 인용과 함께 마크다운, 표, 구조, OCR을 추출합니다.search_pdf: 깊이 있는 읽기 전에 페이지 및 스니펫 일치를 탐색합니다.pdf_evidence: 시각적 크롭, 렌더링, 집중된 증거 작업을 처리합니다.
대상 사용자
금융 보고서, 연구 논문, 스캔된 문서와 같이 정확성과 검증 가능한 인용이 중요한 고위험 문서를 처리해야 하는 AI 에이전트를 개발하는 개발자들을 위한 것입니다.
주요 특징
- 제로 설정 설정: Docker나 API 키 없이
npx -y @sylphx/citra로 즉시 시작 가능합니다. - 로컬 우선 개인정보 보호: 클라우드 비전 API를 필요로 하지 않고, PDF는 로컬 머신에서 처리됩니다.
- 고정밀 추출: 경계 상자와 함께 표의 행, 열, 셀을 정확히 유지합니다.
- MCP 통합: Claude Desktop, Cursor, VS Code 및 기타 MCP 호환 호스트에 내장 지원이 있습니다.
- 고성능: TypeScript 기반 PDF 도구와 비교해 훨씬 낮은 지연 시간을 제공하는 네이티브 Rust 엔진을 사용합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트