RapidAI/RapidOCR
📄 Awesome OCR multiple programing languages toolkits based on ONNX Runtime, OpenVINO, MNN, PaddlePaddle, TensorRT and PyTorch.
解決する課題
RapidOCRは、複数のプラットフォームや言語にわたる迅速なオフライン展開のために設計された、高速なオープンソースの光学文字認識(OCR)ツールを提供します。これは、特に端末デバイス向けの推論プロセスを最適化することで、ディープラーニングOCRモデルに付随しがちなエンジニアリングのオーバーヘッドと展開の複雑さを解消します。
仕組み
このプロジェクトは、PaddleOCRのモデルを互換性の高いONNX形式に変換します。この移行により、さまざまなデバイスでの推論展開が簡素化され、加速されます。システムは複数のプログラミング言語(Python, C++, Java, C#)をサポートしており、ONNX Runtime, TensorRT, OpenVINO, PyTorchなどのさまざまな推論エンジンを使用して実行できます。
対象者
フルトレーニングフレームワークのような重いリソース要件を課すことなく、アプリケーションに高性能なオフラインOCR機能を統合する必要がある開発者。
関連
- プロジェクト
PaddlePaddle/PaddleOCRPaddleOCR は、画像や PDF を構造化された LLM 用の JSON または Markdown に変換するオープンソースの OCR および Document‑AI ツールキットです。多言語シーンテキストモデル (PP‑OCRv6)、表、数式、および古文書のための軽量 Vision‑Language 解析器 (PaddleOCR‑VL‑1.6)、および構造化パイプライン (PP‑StructureV3) を提供します。モデルは CPU, GPU, XPU, NPU または ONNX/TensorRT 経由で動作し、Dify や RAGFlow といった RAG/エージェントプラットフォームと連携可能です。
- プロジェクト
- プロジェクト
zibo-chen/rust-paddle-ocrA lightweight Rust OCR library based on PaddleOCR models and the MNN inference runtime, providing text detection and recognition across multiple languages.
- Dispatch
- Dispatch
PaddleOCR 3.5 リリースノート / 新機能PaddleOCR 3.5 は、サポートされた推論バックエンドとして Hugging Face Transformers を導入し、OCR および文書解析モデルが PyTorch ベースのワークフローによりシームレスに統合できるようにします。