ndl-lab/ndlocr-lite
NDLOCR-Liteアプリケーションのリポジトリ(ソースコードを含む)NDLOCR‑Lite application repository (including source code)
해결하는 문제
NDLOCR-Lite는 책과 잡지의 디지털 이미지에서 텍스트를 추출하기 위한 가벼운 광학 문자 인식(OCR) 솔루션을 제공합니다. 고성능 GPU가 필요 없이 일반적인 가정용 컴퓨터(노트북)와 일반적인 운영체제에서 작동하도록 설계되어, 아카이브 자료의 디지털 이미지에서 빠르게 텍스트를 추출할 수 있습니다.
작동 방식
시스템은 이미지를 텍스트로 변환하기 위해 세 가지 주요 모듈을 결합합니다:
- 레이아웃 인식: DEIMv2를 사용하여 문서의 구조를 식별합니다.
- 문자 인식: PARSeq를 사용하여 실제 문자를 인식합니다.
- 읽기 순서 정렬: 인식된 텍스트를 올바른 순서로 정렬합니다.
모델은 PyTorch로 학습된 후 ONNX 형식으로 변환되어 효율적인 실행이 가능합니다. 애플리케이션은 데스크톱 GUI(Windows, Mac, Linux 지원) 또는 Python을 사용한 명령줄 인터페이스(CLI)로 사용할 수 있습니다.
대상 사용자
고가의 하드웨어(전용 GPU 등)가 없거나, 아카이브 작업에 간단한 데스크톱 애플리케이션을 선호하는 사용자에게 적합합니다. 이미지에서 인쇄체 또는 손글씨 일본어 텍스트를 디지털화해야 하는 분들께 추천합니다.
주요 특징
- 하드웨어 효율적: GPU가 필요 없이 일반적인 CPU에서 빠르게 작동합니다.
- 다중 플랫폼: Windows 11, macOS(Apple M4 포함), Ubuntu 22.04와 호환됩니다.
- 다양한 입력 형식: JPG, PNG, TIFF, JP2, BMP, WebP 등 다양한 이미지 형식을 지원합니다.
- 손글씨 지원: v1.2부터 손글씨 문자 인식이 향상되었습니다.
- 유연한 출력 형식: XML 또는 JSON 형식으로 결과를 출력할 수 있습니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트