sirfz/tesserocr

A Python wrapper for the tesseract-ocr API

解決的問題

它提供了一種對 Python 友好的方式來使用 Tesseract OCR 引擎,讓開發者能夠從影像中提取文字,而無需直接與 Tesseract 的複雜 C++ API 互動。

工作原理

該專案使用 Cython 為 Tesseract C++ API 建立包裝器。這種整合允許在影像處理期間釋放 Python 全局解釋器鎖(GIL),進而當與 Python 的 threading 模組一起使用時,可實現真正的平行執行。

適用對象

需要在其應用程式中整合光學字元辨識(OCR)功能的 Python 開發者,並希望獲得高效率、易於閱讀的介面,且能與 Pillow(PIL)影像庫良好配合。

主要特色

  • Pillow 整合:設計為可與 PIL.Image 物件無縫運作。
  • 平行處理:透過在 OCR 作業期間釋放 GIL,支援真正的多執行緒。
  • 進階 OCR 功能:提供存取 Tesseract 的進階功能,例如方向與文字類型偵測(OSD)、版面分析,以及符號級別的置信度分數。
  • 彈性輸入:支援影像檔案與影像物件。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案