kanadeblisst00/wechat_ocr
使用Python调用微信本地ocr服务
何を解決するか
このプロジェクトは、WeChat Windowsアプリケーション内に統合されたローカルOCR(光学式文字認識)モデルにアクセスするためのPythonラッパーを提供し、開発者がWeChatの組み込み機能を使って画像からテキストを抽出できるようにします。
動作方法
これは純粋なPython実装であり、C++プロジェクト(QQImpl)の呼び出し方法を翻訳しています。Windowsシステム上のローカルWeChat OCR実行ファイルおよびライブラリとやり取りし、画像を処理してコールバック関数を通じて認識結果を返します。
対象ユーザー
WindowsにWeChatをインストールしている開発者で、自作のPythonスクリプトやアプリケーションにWeChatのローカルOCR機能を統合したい人。
特徴
- WeChatの内部モデルを使用したローカルOCR処理。
- より簡単な統合を可能にする純粋なPython実装。
- 結果コールバックメカニズムを備えた非同期タスク処理。
関連
- プロジェクト
sirfz/tesserocr並列実行とPillowの統合をサポートし、画像から効率的にテキストを抽出することを可能にする、Tesseract OCR API用のPythonラッパー。
- プロジェクト
TheJoeFin/Text-GrabText GrabはWindows専用のデスクトップアプリで、スクリーンショット、PDF、UI要素など、画面に表示されるすべてのテキストをローカルOCR(WinAI、WinRT OCR、Tesseract)でキャプチャし、内蔵のクリーニング機能、スプレッドシート編集、正規表現ベースの抽出、再利用可能なキャプチャテンプレート、バッチフォルダ処理、Chrome/Edge拡張機能を提供します。すべての処理はデバイス内に留まり、Copilot+ PCではNPU加速推論もオプション。Microsoft Store、GitHubリリース、パッケージマネージャーからインストール可能。Visual Studioまたは.NET SDKでソースからビルド可能。
- プロジェクト
ok-oldking/ok-scriptWindowsアプリ、ゲーム、Androidデバイス向けのコンピュータビジョンベースのPython自動化フレームワーク。OCRおよびテンプレートマッチングをサポート。
- プロジェクト
pygfx/wgpu-pyGPUグラフィックスおよびコンピューティングアプリケーション向けに強力かつ信頼性の高いインターフェースを提供する、WebGPU APIのPython実装。
- プロジェクト
emgucv/emgucvOpenCV ライブラリのためのクロスプラットフォーム .NET ラッパー。OpenCV の画像処理機能を .NET 互換言語で使用可能にします。