landing-ai/ade-python
Python library for Agentic Document Extraction (ADE).
解決的問題
本函式庫提供了一種將非結構化文件(PDF 和圖像)轉換為結構化、機器可讀數據的程式化方法。它解決了從複雜文件中提取特定類型資訊,同時保持提取文本與其在文件內原始位置之間聯繫(grounding)的問題。
工作原理
本函式庫與 LandingAI Agentic Document Extraction (ADE) API 進行互動。它遵循兩個步驟:
- Parse (解析):將文件轉換為結構化 Markdown,為每個元素建立包含像素座標邊界框(grounding)的結構樹。
- Extract (提取):使用模式(透過 Pydantic 模型、字典或 JSON 定義)從生成的 Markdown 中提取特定的類型化欄位。
對於大型文件,本函式庫支援帶有輪詢和等待輔助函數的非同步作業,以防止逾時。
適用對象
專為構建需要自動執行 PDF 或圖像數據輸入的應用程式的開發人員設計,例如發票處理、身分驗證或任何需要從視覺文件提取結構化數據的流程。
亮點
- 類型化回應:使用 Pydantic 模型進行完全類型化的請求與回應。
- Grounding (落地):為文件元素提供像素座標邊界框,確保數據與來源對齊。
- 靈活的提取:支援使用 Pydantic、dict 或 JSON 模式進行欄位提取。
- 非同步支援:包含同步與非同步用戶端,並為高並發提供選用的
aiohttp後端。 - 作業管理:內建用於管理大型文件長時間執行提取作業的輔助函數。
相關
- 專案
- 專案
- 專案
- 專案
- 專案