Azure-Samples/cognitive-services-speech-sdk
Sample code for the Microsoft Cognitive Services Speech SDK
何を解決するか
このリポジトリは、Microsoft Cognitive Services Speech SDK を使用してアプリケーションに音声機能を統合する開発者を支援する包括的なコードサンプルセットを提供します。SDKのドキュメントと実際の実装の間のギャップを埋め、複数のプラットフォームと言語で実用的な実装を可能にします。
動作方法
プロジェクトは、クイックスタートと高度なサンプルに例を整理しています。これらのサンプルは、SDK を介して Azure Speech Service とやり取りする方法を示しており、主に3つのモダリティをカバーしています:音声認識(音声→テキスト)、音声合成(テキスト→音声)、音声翻訳(音声→音声)。また、接続されたマイクやスピーカーを列挙するなどのオーディオハードウェア管理ツールも含まれています。
対象ユーザー
C++、C#、Java、JavaScript、Node.js、Python、Objective-C、Swift を使用して、Windows、Linux、macOS、Android、iOS、Web など複数のプラットフォームでアプリケーションを開発し、音声インタラクション、音声認識、翻訳機能を追加したい開発者。
主な特徴
- マルチプラットフォーム対応:ほぼすべての主要なOSおよびモバイルプラットフォーム用のサンプル。
- 広範な言語カバー:8種類の異なるプログラミング言語での実装サンプル。
- 音声認識(音声→テキスト):マイクやファイルからのワンショット認識用のクイックスタート。
- 音声合成(テキスト→音声):デフォルトのスピーカーまたは結果バッファへの合成例。
- 音声翻訳:ワンショット翻訳および音声認識サンプル。
- 音声アシスタント統合:DialogServiceConnector を使用したカスタム音声アシスタントの作成サンプル。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト