MohrJonas/obsidian-ocr
Obsidian OCR allows you to search for text in your images and pdfs
何を解決するか
Obsidian OCR は、Obsidian ワルトに保存された画像や PDF 内のテキストを検索できるようにし、非テキスト文書を検索可能にします。
動作方法
このプラグインは OCR(光学式文字認識)プロバイダーを使用してドキュメントを処理します。デフォルトでは、ローカル OCR エンジンである Tesseract と、PDF を画像に変換するための ImageMagick と統合されています。有効化時に自動的にワルトをインデックス化し、新しいファイルが追加されるたびに処理を行い、高速検索のためにキャッシュされたトランスクリプトを作成します。
対象ユーザー
画像や PDF の大量のコレクションを持っている Obsidian ノートアプリのユーザーで、これらのファイル内の特定のコンテンツを検索したい方。
特徴
- ローカル処理: ユーザーのコンピュータ上で Tesseract を使用して OCR をローカルで実行。
- 自動インデックス化: ワルトと新規追加ファイルを自動的に処理し、検索可能にします。
- 自動インストール: Windows、Ubuntu、Arch/Manjaro で Tesseract や ImageMagick などの依存関係をインストールするための初期開発機能を含んでいます。
- カスタマイズ可能設定: 画像の密度、品質、並行 OCR プロセス数を調整可能で、パフォーマンスと CPU 使用率のバランスを取れます。
- 拡張可能: クラス拡張システムにより、カスタム OCR プロバイダーをサポートしています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト