drmingler/docling-api
Easily deployable and scalable backend server that efficiently converts various document formats (pdf, docx, pptx, html, images, etc) into Markdown. With support for both CPU and GPU processing, it is Ideal for large-scale workflows, it offers text/table extraction, OCR, and batch processing with sync/async endpoints.
何を解決するか
このプロジェクトは、PDF、DOCX、PPTX、CSV、HTML、画像、AsciiDoc など、さまざまな文書形式を Markdown に変換するスケーラブルなバックエンドサーバーを提供します。大規模な複雑な文書を効率的に処理する問題を解決し、単一およびバッチ変換のための堅牢な API を提供します。
動作方法
サーバーは IBM の Docling パーサーで駆動されています。REST API 用の FastAPI アプリケーション、タスク処理用の Celery ウーカー、メッセージブローカーおよび結果バックエンドとしての Redis を含む分散アーキテクチャを使用しています。同期(即時)および非同期(ジョブ追跡)の変換モードをサポートしており、CPU または GPU 加速処理の最適化が可能です。
対象ユーザー
LLM パイプラインやデータ抽出タスクなど、後続処理用に多数の多様な文書形式をクリーンな Markdown 形式に変換する必要がある開発者や組織向けです。
主な特徴
- 広範なフォーマット対応: PDF、DOCX、PPTX、HTML、画像(JPG、PNG、TIFF、BMP)、AsciiDoc、CSV を対応。
- 高性能処理: 本番環境向けに GPU 加速を提供し、Celery ウーカーによる水平スケーリングを実現。
- 柔軟な API: 同期による単一/バッチ変換と、ジョブ追跡可能な非同期ジョブをサポート。
- 高度な抽出機能: テーブル検出、画像抽出、多言語 OCR 対応を含む。
- モニタリング: ジョブのステータスやワーカーのパフォーマンスを追跡するための統合 Flower ダッシュボード。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト