audeering/opensmile-python

Python package for openSMILE

何を解決するか

このプロジェクトは openSMILE ツールキット用の Python インターフェースを提供し、音声・視覚信号からの機械学習に使用するため、音声ファイルから標準化された音声特徴を抽出できるようにします。

動作方法

ライブラリは、特徴セット(例:ComParE 2016、GeMAPS、eGeMAPS)と特徴レベル(低レベル記述子または関数的特徴)を指定できるようにします。その後、音声ファイルを処理してこれらの特定の音響特徴を抽出し、ML モデルの入力として使用できます。

対象ユーザー

音声分析および音声・視覚信号からの機械学習に取り組む研究者や開発者で、標準化された高次元音声特徴抽出が必要な方々。

特徴

  • 標準化された特徴セット:ComParE 2016(6,000 以上の特徴)、GeMAPS、eGeMAPS をサポート。
  • 複数の抽出レベル:低レベル記述子(LDD)と関数的特徴、および ComParE 2016 用の LLD ダルタをサポート。
  • シンプルな Python API:数行のコードで音声ファイルから特徴を抽出可能。
  • コミュニティ拡張:コミュニティによって追加された特徴セットも利用可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト