sandrohanea/whisper.net
Whisper.net. Speech to text made simple using Whisper Models
What it solves
Whisper.net は、OpenAI の Whisper の .NET バインディングを提供し、開発者が C# や .NET アプリケーションに高品質な音声-テキスト変換および翻訳機能を直接統合できるようにします。ネイティブ C++ コードを書く必要はありません。
How it works
whisper.cpp のラッパーとして機能し、Ggml モデルを使用して推論を行います。このプロジェクトは、プラットフォームとハードウェアに基づいて最適な利用可能なハードウェアアクセラレーションを自動的に選択する柔軟なランタイムシステムを提供します。CPU、NVIDIA CUDA (12 および 13)、Apple CoreML、Intel OpenVino、Vulkan をサポートしています。
Who it’s for
Windows, Linux, macOS, iOS, Android, および WebAssembly 上で、ローカルかつオフラインの音声認識および翻訳をアプリケーションに実装したい .NET 開発者。
Highlights
Multi-platform support: Works across desktop, mobile, and web (WASM).
Hardware acceleration: Built-in support for CUDA, CoreML, OpenVino, and Vulkan.
Automatic runtime selection: 利用可能なドライバーとハードウェアに基づいて、GPU から CPU へ透過的にフォールバックします。
Easy model management: Ggml モデルと Silero VAD (Voice Activity Detection) モデルのための Hugging Face ダウンローダーが含まれています。
Flexible loading: モデルはファイル、ストリーム、またはバッファからロードできます。