robertknight/ocrs

Rust library and CLI tool for OCR (extracting text from images)

解决的问题

Ocrs 旨在从图像中提取文本(OCR),同时减少传统 OCR 引擎(如 Tesseract)通常需要的手动图像预处理。其目标是提供一个现代化、易于编译的 OCR 引擎,可在多种平台运行,包括 WebAssembly。

工作原理

该项目使用在 PyTorch 中训练的神经网络模型,这些模型随后被导出为 ONNX 格式,并通过 RTen 引擎执行。这一以机器学习为核心的流水线能够处理各种图像类型,如扫描文档、截图和包含文本的照片。

适用人群

适用于需要一个易于部署且跨平台兼容的 Rust 基 OCR 库或 CLI 工具的开发者。

主要亮点

  • 跨平台支持:兼容多种平台,包括 WebAssembly。
  • 机器学习驱动的流水线:使用 PyTorch 和 ONNX 以最小化预处理工作量。
  • 开放数据集:在开放且宽松许可的数据集上进行训练。
  • CLI 功能:包含一个命令行工具,支持从文件或系统剪贴板读取,并输出文本、JSON 布局信息或带注释的图像。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目