MohrJonas/obsidian-ocr

Obsidian OCR allows you to search for text in your images and pdfs

해결하는 문제

Obsidian OCR는 Obsidian 백업에 저장된 이미지와 PDF 내부의 텍스트를 검색할 수 있게 해주며, 비텍스트 문서를 검색 가능하게 만듭니다.

작동 방식

이 플러그인은 OCR(광학 문자 인식) 제공자를 사용하여 문서를 처리합니다. 기본적으로 Tesseract라는 로컬 OCR 엔진과 PDF를 이미지로 변환하기 위한 ImageMagick와 통합됩니다. 활성화 시 자동으로 백업을 인덱싱하고, 새로운 파일이 추가될 때마다 처리하여 빠른 검색을 위한 캐시된 전사본을 생성합니다.

대상 사용자

이미지와 PDF 파일을 많이 보유하고 있으며, 이러한 파일 내 특정 내용을 검색할 수 있어야 하는 Obsidian 노트 앱 사용자.

주요 기능

  • 로컬 처리: 사용자의 컴퓨터에서 Tesseract를 사용하여 OCR를 로컬로 수행합니다.
  • 자동 인덱싱: 백업과 새로운 파일을 자동으로 처리하여 검색 가능하게 합니다.
  • 자동 설치: Windows, Ubuntu, Arch/Manjaro에서 Tesseract 및 ImageMagick와 같은 종속성 설치를 도와주는 초기 개발 기능을 포함합니다.
  • 사용자 정의 설정: 이미지 밀도, 품질, 동시 OCR 프로세스 수를 조정하여 성능과 CPU 사용량의 균형을 맞출 수 있습니다.
  • 확장성: 클래스 확장 시스템을 통해 사용자 정의 OCR 제공자를 지원합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트