diegomarzaa/pdf-ocr-obsidian

Convert your PDFs into Markdown files easily with Mistral OCR Software

해결하는 문제

스캔된 PDF에서 텍스트와 이미지를 수동으로 추출하는 작업을 자동화하며, 문서의 계층 구조와 이미지 참조를 유지한 채 구조화된 Markdown 파일로 변환합니다. 특히 Obsidian에서 사용하기 위해 최적화되어 있습니다.

작동 방식

이 도구는 Mistral AI OCR API를 사용하여 PDF를 처리합니다. 지정된 입력 폴더에서 파일을 스캔하고, API에 업로드한 후 응답을 분석하여 Markdown 파일을 생성합니다. 이미지는 별도로 추출되어 Obsidian 스타일의 위키 링크(![[image-name]])를 사용해 텍스트 내에 링크합니다. 중복된 API 호출을 방지하기 위해 시스템은 원시 OCR 응답을 JSON 파일로 캐시합니다.

대상 사용자

스캔된 PDF 콘텐츠를 지식 기반에 가져오면서 이미지와 구조를 유지하고 싶은 Obsidian 사용자.

주요 기능

  • 배치 처리: 폴더 내 여러 PDF를 자동으로 처리합니다.
  • Obsidian 통합: 이미지에 위키 링크를 사용하여 Obsidian 백업과의 호환성을 보장합니다.
  • 유연한 인터페이스: 로컬 웹 애플리케이션과 Jupyter Notebook 모두에서 사용 가능합니다.
  • OCR 캐싱: API 응답을 JSON으로 저장하여 반복적인 비용이나 호출을 방지합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트