Azure-Samples/cognitive-services-speech-sdk

Sample code for the Microsoft Cognitive Services Speech SDK

解决的问题

此仓库提供了一套全面的代码示例,帮助开发人员使用 Microsoft Cognitive Services Speech SDK 将语音功能集成到其应用程序中。它弥合了 SDK 文档与跨多个平台和语言的实际实现之间的差距。

工作原理

该项目将示例组织为快速入门和高级示例。这些示amples展示了如何通过 SDK 与 Azure 语音服务进行交互,涵盖三种主要模式:语音转文本(识别)、文本转语音(合成)以及语音转语音(翻译)。它还包含用于管理音频硬件的工具,例如枚举连接的麦克风和扬声器。

适用人群

需要使用 C++、C#、Java、JavaScript、Node.js、Python、Objective-C 或 Swift 在 Windows、Linux、macOS、Android、iOS 和 Web 等跨平台应用程序中添加语音交互、转录或翻译功能的开发人员。

主要亮点

  • 多平台支持:几乎涵盖所有主要操作系统和移动平台的示例。
  • 广泛的语言覆盖:提供八种不同编程语言的实现示例。
  • 语音转文本:支持从麦克风和文件进行一次性识别的快速入门示例。
  • 文本转语音:将合成结果输出到默认扬声器或结果缓冲区的示例。
  • 语音翻译:支持一次性翻译和转录的示例。
  • 语音助手集成:使用 DialogServiceConnector 创建自定义语音助手的示例。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目