SubhamTyagi/android-ocr

Tesseract based OCR for android

解决的问题

提供一种注重隐私的方式,可在无需互联网连接的情况下从 Android 设备上的图像中提取文本,支持超过 120 种语言和数学公式。

工作原理

该应用通过 Tesseract4Android 库使用 Tesseract 5 OCR 引擎,在设备本地处理图像。用户可以裁剪图像的特定区域以进行精确识别,然后将结果文本复制到剪贴板。

适用人群

需要在保持隐私的前提下,通过离线处理将图像中的文本数字化的 Android 用户。

主要亮点

  • 离线识别:所有处理均在设备上完成。
  • 广泛的语言支持:支持 120 多种语言,包括在一张图像中处理多种语言的能力。
  • 数学公式支持:能够识别数学公式。
  • 图像工具:内置裁剪功能,并可直接从图库中将图像分享到应用中。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目