robertknight/ocrs
Rust library and CLI tool for OCR (extracting text from images)
해결하는 문제
Ocrs는 기존의 Tesseract와 같은 오래된 엔진에서 일반적으로 요구되는 수동 이미지 전처리의 필요성을 줄이면서 이미지에서 텍스트를 추출하는(OCR) 것을 목적으로 설계되었습니다. 다양한 플랫폼, 특히 WebAssembly에서도 작동하는 현대적이고 컴파일이 쉬운 OCR 엔진을 제공하는 것을 목표로 합니다.
작동 방식
이 프로젝트는 PyTorch에서 훈련된 신경망 모델을 사용하며, 이 모델들은 ONNX 형식으로 내보내져 RTen 엔진을 통해 실행됩니다. 이 기계학습 중심의 파이프라인은 스캔 문서, 스크린샷, 텍스트를 포함한 사진과 같은 다양한 이미지 유형을 처리할 수 있습니다.
대상 사용자
Rust 기반의 OCR 라이브러리나 CLI 도구가 필요하고, 배포가 간편하며 크로스플랫폼 호환성을 갖춘 개발자들을 위한 것입니다.
주요 특징
- 크로스플랫폼 지원: WebAssembly를 포함한 여러 플랫폼에서 호환 가능.
- ML 기반 파이프라인: PyTorch와 ONNX를 사용하여 전처리 작업을 최소화.
- 오픈 데이터셋: 오픈 소스이자 유연한 라이선스가 적용된 데이터셋으로 훈련됨.
- CLI 기능: 파일 또는 시스템 클립보드에서 읽고, 텍스트, JSON 레이아웃 정보, 또는 주석이 추가된 이미지를 출력할 수 있는 명령줄 도구 포함.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트