sirfz/tesserocr
A Python wrapper for the tesseract-ocr API
解決的問題
它提供了一種對 Python 友好的方式來使用 Tesseract OCR 引擎,讓開發者能夠從影像中提取文字,而無需直接與 Tesseract 的複雜 C++ API 互動。
工作原理
該專案使用 Cython 為 Tesseract C++ API 建立包裝器。這種整合允許在影像處理期間釋放 Python 全局解釋器鎖(GIL),進而當與 Python 的 threading 模組一起使用時,可實現真正的平行執行。
適用對象
需要在其應用程式中整合光學字元辨識(OCR)功能的 Python 開發者,並希望獲得高效率、易於閱讀的介面,且能與 Pillow(PIL)影像庫良好配合。
主要特色
- Pillow 整合:設計為可與
PIL.Image物件無縫運作。 - 平行處理:透過在 OCR 作業期間釋放 GIL,支援真正的多執行緒。
- 進階 OCR 功能:提供存取 Tesseract 的進階功能,例如方向與文字類型偵測(OSD)、版面分析,以及符號級別的置信度分數。
- 彈性輸入:支援影像檔案與影像物件。
相關
- 專案
- 專案
- 專案
- 專案
- 專案