diegomarzaa/pdf-ocr-obsidian

Convert your PDFs into Markdown files easily with Mistral OCR Software

何を解決するか

スキャンされたPDFからテキストと画像を手動で抽出する作業を自動化し、ドキュメントの階層構造と画像参照を維持したまま、構造化されたMarkdownファイルに変換します。特にObsidianでの使用を最適化しています。

動作方法

このツールはMistral AI OCR APIを使用してPDFを処理します。指定された入力フォルダ内のファイルをスキャンし、APIにアップロードして応答を解析し、Markdownファイルを作成します。画像は別途抽出され、Obsidian形式のウィキリンク(![[image-name]])を使用してテキスト内にリンクされます。重複したAPI呼び出しを防ぐために、システムはOCRの応答をJSONファイルとしてキャッシュします。

対象ユーザー

スキャンされたPDFのコンテンツを知識ベースにインポートしたいObsidianユーザーで、画像と構造を保持したい方。

特徴

  • バッチ処理: フォルダ内の複数のPDFを自動的に処理します。
  • Obsidian統合: 画像にウィキリンクを使用することで、Obsidianバケツとの互換性を確保します。
  • 柔軟なインターフェース: ローカルWebアプリとJupyter Notebookの両方で利用可能。
  • OCRキャッシュ: API応答をJSONに保存し、繰り返しのコストや呼び出しを回避します。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト