ocrmypdf/OCRmyPDF
OCRmyPDF adds an OCR text layer to scanned PDF files, allowing them to be searched
해결하는 문제
OCRmyPDF 는 텍스트의 이미지에 불과한 스캔된 PDF 파일을 숨겨진 OCR 텍스트 레이어를 추가함으로써 검색 가능하고 복사/붙여넣기 가능한 문서로 변환합니다. 다른 OCR 도구에서 흔히 발생하는 텍스트 오류, 다국어 지원 부족, 이미지 해상도 손실, 과도하거나 유효하지 않은 PDF 파일 생성 등의 문제를 해결합니다.
작동 방식
Python 으로 작성된 스크립터블한 명령줄 도구로, Tesseract OCR 엔진을 통합하여 100개 이상의 언어를 인식합니다. 이 도구는 PDF 를 처리하고, 선택적으로 이미지를 정리(페이지 기울기 보정 또는 회전)한 후, 인식된 텍스트를 원본 이미지 아래 정확하게 삽입합니다. PDF/A 파일(장기 보존을 위한 특화된 형식)을 생성할 수 있으며, 여러 CPU 코어를 활용해 작업을 분산하여 효율성을 높입니다.
대상 사용자
대량의 스캔 문서를 디지털화해야 하는 사용자, 명령줄을 통해 PDF 처리를 자동화하고자 하는 개발자, 장기 보존을 위해 유효한 PDF/A 파일이 필요한 조직에게 적합합니다.
주요 특징
- 고정밀도: 원본 이미지 해상도를 유지하고 가능한 한 손실 없는 작업을 수행합니다.
- 최적화: 입력 파일보다 종종 최종 파일 크기를 줄입니다.
- 이미지 보정: 기울어진 페이지나 잘못 회전된 페이지를 보정하는 내장 기능을 제공합니다.
- 확장성: Tesseract 외에 EasyOCR 또는 PaddleOCR 와 같은 다른 엔진으로 교체할 수 있는 플러그인 인터페이스를 제공합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트