Azure-Samples/cognitive-services-speech-sdk

Sample code for the Microsoft Cognitive Services Speech SDK

何を解決するか

このリポジトリは、Microsoft Cognitive Services Speech SDK を使用してアプリケーションに音声機能を統合する開発者を支援する包括的なコードサンプルセットを提供します。SDKのドキュメントと実際の実装の間のギャップを埋め、複数のプラットフォームと言語で実用的な実装を可能にします。

動作方法

プロジェクトは、クイックスタートと高度なサンプルに例を整理しています。これらのサンプルは、SDK を介して Azure Speech Service とやり取りする方法を示しており、主に3つのモダリティをカバーしています:音声認識(音声→テキスト)、音声合成(テキスト→音声)、音声翻訳(音声→音声)。また、接続されたマイクやスピーカーを列挙するなどのオーディオハードウェア管理ツールも含まれています。

対象ユーザー

C++、C#、Java、JavaScript、Node.js、Python、Objective-C、Swift を使用して、Windows、Linux、macOS、Android、iOS、Web など複数のプラットフォームでアプリケーションを開発し、音声インタラクション、音声認識、翻訳機能を追加したい開発者。

主な特徴

  • マルチプラットフォーム対応:ほぼすべての主要なOSおよびモバイルプラットフォーム用のサンプル。
  • 広範な言語カバー:8種類の異なるプログラミング言語での実装サンプル。
  • 音声認識(音声→テキスト):マイクやファイルからのワンショット認識用のクイックスタート。
  • 音声合成(テキスト→音声):デフォルトのスピーカーまたは結果バッファへの合成例。
  • 音声翻訳:ワンショット翻訳および音声認識サンプル。
  • 音声アシスタント統合:DialogServiceConnector を使用したカスタム音声アシスタントの作成サンプル。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト