landing-ai/ade-python

Python library for Agentic Document Extraction (ADE).

해결하는 문제

이 라이브러리는 비구조화된 문서(PDF 및 이미지)를 구조화된 기계 판독 가능 데이터로 변환하는 프로그래밍 방식을 제공합니다. 복잡한 문서에서 특정 타입의 정보를 추출하는 동시에, 추출된 텍스트와 문서 내 원래 위치 사이의 연결(grounding)을 유지하는 문제를 해결합니다.

작동 방식

이 라이브러리는 LandingAI Agentic Document Extraction (ADE) API와 인터페이스합니다. 다음의 2단계 프로세스를 따릅니다:

  1. Parse: 문서를 구조화된 Markdown으로 변환하며, 모든 요소에 대해 픽셀 좌표 바운딩 박스(grounding)를 포함하는 구조 트리를 생성합니다.
  2. Extract: 스키마(Pydantic 모델, 딕셔너리 또는 JSON을 통해 정의됨)를 사용하여 생성된 Markdown에서 특정 타입의 필드를 추출합니다.

대용량 문서의 경우, 이 라이브러리는 타임아웃을 방지하기 위한 폴링 및 대기 헬퍼가 포함된 비동기 작업을 지원합니다.

대상 사용자

송장 처리, 신원 확인 또는 시각적 문서에서 구조화된 데이터 추출이 필요한 모든 워크플로우와 같이 PDF 또는 이미지에서 데이터 입력을 자동화해야 하는 애플리케이션을 구축하는 개발자를 위해 설계되었습니다.

주요 특징

  • 타입 지정 응답: 완전히 타입이 지정된 요청 및 응답을 위해 Pydantic 모델을 사용합니다.
  • Grounding: 데이터가 소스에 기반하도록 문서 요소에 대한 픽셀 좌표 바운딩 박스를 제공합니다.
  • 유연한 추출: 필드 추출을 위해 Pydantic, dict 또는 JSON 스키마를 지원합니다.
  • 비동기 지원: 동기 및 비동기 클라이언트를 모두 포함하며, 높은 동시성을 위해 선택적 aiohttp 백엔드를 제공합니다.
  • 작업 관리: 대용량 파일에 대한 장시간 실행되는 추출 작업을 관리하기 위한 내장 헬퍼가 포함되어 있습니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트