robertknight/ocrs
Rust library and CLI tool for OCR (extracting text from images)
解決的問題
Ocrs 是設計用於從影像中提取文字(OCR),同時減少傳統引擎(如 Tesseract)通常所需的大量手動影像前處理。目標是提供一個現代化、易於編譯的 OCR 引擎,可在多種平台運作,包括 WebAssembly。
工作原理
本專案使用在 PyTorch 中訓練的神經網路模型,這些模型隨後被匯出為 ONNX 格式,並透過 RTen 引擎執行。此以機器學習為核心的流程可處理多種影像類型,例如掃描文件、螢幕截圖以及含文字的照片。
適用對象
適合需要一個易於部署且跨平台相容的 Rust 基底 OCR 套件或 CLI 工具的開發者。
主要特色
- 跨平台支援:相容多種平台,包括 WebAssembly。
- 機器學習驅動的流程:使用 PyTorch 與 ONNX 以最小化前處理工作量。
- 開放資料集:在開放且自由授權的資料集上訓練而成。
- CLI 功能:內建命令列工具,支援從檔案或系統剪貼簿讀取,並輸出文字、JSON 排版資訊或帶註解的影像。
相關
- 專案
- 專案
- 專案
- 專案
- 專案