audeering/opensmile-python

Python package for openSMILE

解决的问题

该项目为 openSMILE 工具包提供了 Python 接口,使用户能够从音频文件中提取标准化的音频特征,用于从音视频信号进行机器学习。

工作原理

该库允许用户指定特征集(如 ComParE 2016、GeMAPS 或 eGeMAPS)和特征级别(低级描述符或函数性特征)。然后处理音频文件以提取这些特定的声学特征,可作为机器学习模型的输入。

适用人群

需要标准化、高维音频特征提取的音频分析和音视频信号机器学习研究人员及开发者。

主要亮点

  • 标准化特征集:支持 ComParE 2016(超过 6,000 个特征)、GeMAPS 和 eGeMAPS。
  • 多种提取级别:支持低级描述符(LDD)和函数性特征,以及 ComParE 2016 的 LLD 差分。
  • 简洁的 Python API:仅需几行代码即可从音频文件中提取特征。
  • 社区扩展:社区已添加了额外的特征集。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目