sirfz/tesserocr
A Python wrapper for the tesseract-ocr API
무엇을 해결하는가
Tesseract OCR 엔진을 사용하는 Python 친화적인 방법을 제공하여, 개발자가 Tesseract의 복잡한 C++ API와 직접 상호작용할 필요 없이 이미지에서 텍스트를 추출할 수 있게 합니다.
작동 방식
이 프로젝트는 Cython을 사용하여 Tesseract C++ API를 감싸는 래퍼(wrapper)를 생성합니다. 이러한 통합을 통해 이미지 처리 중 Python의 Global Interpreter Lock (GIL)을 해제할 수 있으며, 이는 Python의 threading 모듈과 함께 사용할 때 진정한 병렬 실행을 가능하게 합니다.
대상 사용자
애플리케이션에 광학 문자 인식(OCR)을 통합해야 하며, Pillow (PIL) 이미지 라이브러리와 잘 작동하는 고성능의 읽기 쉬운 인터페이스를 원하는 Python 개발자.
주요 특징
- Pillow 통합:
PIL.Image객체와 원활하게 작동하도록 설계되었습니다. - 병렬 처리: OCR 작업 중 GIL을 해제하여 실제 멀티스레딩을 지원합니다.
- 고급 OCR 기능: 방향 및 스크립트 감지(OSD), 레이아웃 분석, 심볼 수준의 신뢰도 점수와 같은 Tesseract의 고급 기능을 사용할 수 있습니다.
- 유연한 입력: 이미지 파일과 이미지 객체를 모두 지원합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트