nguyenq/tess4j
Java JNA wrapper for Tesseract OCR API
何を解決するか
Tesseract OCR(光学式文字認識)機能をJavaアプリケーション内で使用できるようにし、ネイティブなC++コードを書く必要がなくなります。
動作方法
Java Native Access(JNA)を介してTesseract OCR APIをラップし、Javaプログラムが下位のTesseractエンジンを呼び出して画像からテキストを抽出できるようにします。
対象ユーザー
画像やPDFドキュメントからテキストを抽出する必要があるJava開発者
特徴
- TIFF、JPEG、GIF、PNG、BMPなど複数の画像形式をサポート。
- 複数ページのTIFF画像を処理可能。
- PDFドキュメント形式をサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト