icereed/paperless-gpt
Use LLMs and LLM Vision (OCR) to handle paperless-ngx - Document Digitalization powered by AI
解決的問題
paperless-gpt 是 paperless-ngx 的 AI 驅動型輔助工具,旨在自動化繁瑣的手動文件分類工作。它解決了在低品質掃描件或複雜版面文件中,傳統 OCR 常常難以處理的手動命名、標籤化和資料提取問題。
工作原理
該工具透過 API 與 paperless-ngx 集成,利用大型語言模型(LLM)和專業 OCR 服務分析文件內容。可配置多種提供者,分別用於通用 LLM 任務(如命名)和特定 OCR 任務(如文字提取)。
- OCR 提供商:支援基於 LLM 的 OCR(使用具備視覺能力的模型如 GPT-4o 或 MiniCPM-V)、Azure Document Intelligence、Google Document AI 以及自架設的 Docling 伺服器。
- 元資料生成:AI 分析提取的文字,自動為文件生成標題、標籤、建立日期和對應人。
- 自訂欄位提取:支援三種寫入模式(追加、更新、取代),可將特定資料提取至自訂欄位中。
- PDF 增強:使用 Google Document AI 時,可生成帶有透明文字層的可搜尋 PDF,覆蓋在原始影像之上。
適用對象
希望自動化文件管理流程的 paperless-ngx 使用者,特別是處理大量掃描文件或需要從雜亂掃描件中高精度提取文字的使用者。
主要亮點
- LLM 增強 OCR:使用視覺 LLM 將低品質掃描件轉化為具備上下文感知能力的文字。
- 自動整理:自動生成功能標題、標籤、日期和對應人。
- 可自訂提示:透過 Web UI 直接管理標題和標籤的 AI 提示。
- 靈活的 OCR 選項:支援多種企業級和本地提供者(OpenAI、Ollama、Azure、Google、Docling)。
- 臨時分析:允許使用者對選定文件進行自訂分析或摘要。
- 可搜尋 PDF:透過 Google Document AI 生成可選中文本層的 PDF。
- Docker 部署:可透過 Docker Compose 與 paperless-ngx 一起輕鬆部署。
相關
- 專案
- 專案
- 專案
- 專案
- 專案