diegomarzaa/pdf-ocr-obsidian

Convert your PDFs into Markdown files easily with Mistral OCR Software

解决的问题

自动化将PDF文档转换为结构化Markdown文件,特别针对Obsidian使用进行优化。解决了手动从扫描PDF中提取文本和图像的问题,同时保持文档层级结构和图像引用。

工作原理

该工具使用Mistral AI OCR API处理PDF。它会扫描指定的输入文件夹中的文件,上传至API,然后解析响应以创建Markdown文件。图像被单独提取,并使用Obsidian风格的wikilink(![[image-name]])在文本中进行链接。为避免重复的API调用,系统将原始OCR响应缓存为JSON文件。

适用人群

希望将扫描PDF内容导入知识库,同时保留图像和结构的Obsidian用户。

特色

  • 批量处理:自动处理文件夹中的多个PDF。
  • Obsidian集成:使用wikilink链接图像,确保与Obsidian库的兼容性。
  • 灵活接口:提供本地Web应用和Jupyter Notebook两种形式。
  • OCR缓存:将API响应保存为JSON以避免重复成本或调用。

相关

  • 项目
  • 项目
  • 项目
  • 项目