PFCCLab/PPOCRLabel
PPOCRLabelv3 is a semi-automatic graphic annotation tool suitable for OCR field, with built-in PP-OCR model to automatically detect and re-recognize data.
해결하는 문제
PPOCRLabelv3는 광학 문자 인식(OCR) 작업을 위해 특별히 설계된 반자동 그래픽 주석 도구입니다. 내장된 AI 모델을 사용해 텍스트 영역을 자동으로 탐지하고 문자를 인식함으로써 수작업 라벨링의 번거로움을 제거합니다. 사용자는 이를 수동으로 보정하여 OCR 모델용 고품질 학습 데이터셋을 생성할 수 있습니다.
작동 방식
Python3 및 PyQT5로 작성되었으며, PP-OCR 모델을 통합하여 자동 탐지 및 인식을 수행합니다. 사용자는 이미지 디렉터리를 열고 소프트웨어가 자동으로 경계 박스와 텍스트 라벨을 생성합니다. 사용자는 결과를 검토한 후 다양한 도구와 단축키를 사용해 텍스트를 수동으로 수정하거나 박스 위치를 조정합니다. 확인 후 라벨은 Label.txt 및 rec_gt.txt와 같은 형식으로 내보내져 PP-OCR 학습 파이프라인과 직접 호환됩니다.
대상 사용자
대량의 이미지를 라벨링하여 검출 및 인식 모델을 학습시키는 데 필요한 개발자 및 데이터 과학자들, 특히 표나 키 정보 추출(KIE) 작업과 같은 구조화된 데이터를 다루는 사람들에게 적합합니다.
주요 기능
- 다중 모드 주석: 사각형 박스, 비정형 다점 다각형, 표 구조, 키 정보 추출(KIE)을 지원합니다.
- 반자동 라벨링: 내장된 PP-OCR 모델을 통해 '자동 인식'과 '재인식' 기능을 제공하여 라벨링 속도를 높입니다.
- 표 추출: 표 구조를 추출하고 Excel 형식으로 변환하는 전용 워크플로우를 포함합니다.
- 사용자 정의 모델 지원: 명령줄 매개변수를 통해 기본 초경량 모델을 사용자 정의 추론 모델로 교체할 수 있습니다.
- 정밀 제어: 특정 단축키(
z,x,c,v)를 사용해 경계 박스의 꼭짓점을 세밀하게 조정하여 정확한 정렬을 가능하게 합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트