landing-ai/ade-python

Python library for Agentic Document Extraction (ADE).

解決する課題

このライブラリは、非構造化ドキュメント(PDFおよび画像)を構造化されたマシン読み取り可能なデータに変換するプログラムによる方法を提供します。複雑なドキュメントから特定の型付き情報を抽出しつつ、抽出されたテキストとドキュメント内の元の位置との間のリンク(グラウンディング)を維持するという問題を解決します。

仕組み

このライブラリは、LandingAI Agentic Document Extraction (ADE) APIと連携します。以下の2段階のプロセスに従います:

  1. Parse (解析): ドキュメントを構造化されたMarkdownに変換し、すべての要素に対してピクセル座標のバウンディングボックス(グラウンディング)を含む構造ツリーを作成します。
  2. Extract (抽出): スキーマ(Pydanticモデル、辞書、またはJSONで定義)を使用して、生成されたMarkdownから特定の型付きフィールドを抽出します。

大規模なドキュメントの場合、このライブラリはタイムアウトを防ぐためのポーリングおよび待機ヘルパーを備えた非同期ジョブをサポートしています。

対象ユーザー

請求書処理、本人確認、または視覚的ドキュメントからの構造化データ抽出を必要とするあらゆるワークフローなど、PDFや画像からのデータ入力を自動化する必要があるアプリケーションを構築する開発者向けに設計されています。

ハイライト

  • 型付きレスポンス: Pydanticモデルを使用して、完全に型定義されたリクエストとレスポンスを提供します。
  • グラウンディング: ドキュメント要素のピクセル座標バウンディングボックスを提供し、データがソースに基づいていることを保証します。
  • 柔軟な抽出: フィールド抽出にPydantic、dict、またはJSONスキーマをサポートしています。
  • 非同期サポート: 同期および非同期クライアントの両方を含み、高並行性のためにオプションの aiohttp バックエンドを備えています。
  • ジョブ管理: 大規模なファイルに対する長時間実行の抽出ジョブを管理するための組み込みヘルパーを備えています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト