MohrJonas/obsidian-ocr

Obsidian OCR allows you to search for text in your images and pdfs

解決的問題

Obsidian OCR 提供了一種在 Obsidian 儲存庫中儲存的圖片和 PDF 內容中搜尋文字的方法,使非文字文件可被搜尋。

工作原理

此外掛程式使用 OCR(光學字元辨識)提供者來處理文件。預設情況下,它整合了 Tesseract(本地 OCR 引擎)與 ImageMagick,用於將 PDF 轉換為影像進行處理。啟用後會自動索引儲存庫,並在新增檔案時自動處理,建立快取的轉錄文字以實現快速搜尋。

適用對象

使用 Obsidian 記事應用且擁有大量圖片與 PDF 檔案,需要透過搜尋找出其中特定內容的使用者。

主要特色

  • 本地處理:使用 Tesseract 在使用者電腦上本地執行 OCR。
  • 自動索引:自動處理儲存庫與新增內容,確保可搜尋性。
  • 自動安裝:包含早期開發功能,可協助在 Windows、Ubuntu 與 Arch/Manjaro 上安裝 Tesseract 與 ImageMagick 等相依套件。
  • 可自訂設定:允許使用者調整影像密度、品質以及並行 OCR 進程數量,以平衡效能與 CPU 使用率。
  • 可擴充:透過類別擴充系統支援自訂 OCR 提供者。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案