diegomarzaa/pdf-ocr-obsidian
Convert your PDFs into Markdown files easily with Mistral OCR Software
解决的问题
自动化将PDF文档转换为结构化Markdown文件,特别针对Obsidian使用进行优化。解决了手动从扫描PDF中提取文本和图像的问题,同时保持文档层级结构和图像引用。
工作原理
该工具使用Mistral AI OCR API处理PDF。它会扫描指定的输入文件夹中的文件,上传至API,然后解析响应以创建Markdown文件。图像被单独提取,并使用Obsidian风格的wikilink(![[image-name]])在文本中进行链接。为避免重复的API调用,系统将原始OCR响应缓存为JSON文件。
适用人群
希望将扫描PDF内容导入知识库,同时保留图像和结构的Obsidian用户。
特色
- 批量处理:自动处理文件夹中的多个PDF。
- Obsidian集成:使用wikilink链接图像,确保与Obsidian库的兼容性。
- 灵活接口:提供本地Web应用和Jupyter Notebook两种形式。
- OCR缓存:将API响应保存为JSON以避免重复成本或调用。
相关
- 项目
- 项目
- 项目
- 项目