diegomarzaa/pdf-ocr-obsidian
Convert your PDFs into Markdown files easily with Mistral OCR Software
何を解決するか
スキャンされたPDFからテキストと画像を手動で抽出する作業を自動化し、ドキュメントの階層構造と画像参照を維持したまま、構造化されたMarkdownファイルに変換します。特にObsidianでの使用を最適化しています。
動作方法
このツールはMistral AI OCR APIを使用してPDFを処理します。指定された入力フォルダ内のファイルをスキャンし、APIにアップロードして応答を解析し、Markdownファイルを作成します。画像は別途抽出され、Obsidian形式のウィキリンク(![[image-name]])を使用してテキスト内にリンクされます。重複したAPI呼び出しを防ぐために、システムはOCRの応答をJSONファイルとしてキャッシュします。
対象ユーザー
スキャンされたPDFのコンテンツを知識ベースにインポートしたいObsidianユーザーで、画像と構造を保持したい方。
特徴
- バッチ処理: フォルダ内の複数のPDFを自動的に処理します。
- Obsidian統合: 画像にウィキリンクを使用することで、Obsidianバケツとの互換性を確保します。
- 柔軟なインターフェース: ローカルWebアプリとJupyter Notebookの両方で利用可能。
- OCRキャッシュ: API応答をJSONに保存し、繰り返しのコストや呼び出しを回避します。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト