MohrJonas/obsidian-ocr

Obsidian OCR allows you to search for text in your images and pdfs

解决的问题

Obsidian OCR 提供了一种在 Obsidian 仓库中存储的图像和 PDF 内容中搜索文本的方法,使非文本文档可被搜索。

工作原理

该插件使用 OCR(光学字符识别)提供者来处理文档。默认情况下,它集成了 Tesseract(本地 OCR 引擎)和 ImageMagick,用于将 PDF 转换为图像进行处理。启用后会自动索引仓库,并在新文件添加时自动处理,创建缓存的转录文本以实现快速搜索。

适用人群

使用 Obsidian 笔记应用且拥有大量图像和 PDF 文件,需要通过搜索查找其中特定内容的用户。

主要亮点

  • 本地处理:使用 Tesseract 在用户计算机上本地执行 OCR。
  • 自动索引:自动处理仓库及新增内容,确保可搜索性。
  • 自动安装:包含早期开发功能,可帮助在 Windows、Ubuntu 和 Arch/Manjaro 上安装 Tesseract 和 ImageMagick 等依赖项。
  • 可自定义设置:允许用户调整图像密度、质量以及并发 OCR 进程数量,以平衡性能与 CPU 使用率。
  • 可扩展:通过类扩展系统支持自定义 OCR 提供者。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目