audeering/opensmile-python
Python package for openSMILE
해결하는 문제
이 프로젝트는 openSMILE 툴킷용 Python 인터페이스를 제공하여, 음성-시각 신호에서 기계학습을 위해 오디오 파일에서 표준화된 음성 특징을 추출할 수 있도록 합니다.
작동 방식
라이브러리는 특징 세트(예: ComParE 2016, GeMAPS, eGeMAPS)와 특징 수준(저수준 기술자 또는 기능적 특징)을 지정할 수 있게 합니다. 이후 오디오 파일을 처리하여 이러한 특정 음향 특징을 추출하며, 이를 ML 모델의 입력으로 사용할 수 있습니다.
대상 사용자
음성 분석 및 음성-시각 신호에서의 기계학습에 종사하는 연구자 및 개발자로, 표준화된 고차원 음성 특징 추출이 필요한 분들입니다.
주요 특징
- 표준화된 특징 세트: ComParE 2016(6,000개 이상의 특징), GeMAPS, eGeMAPS를 지원합니다.
- 다양한 추출 수준: 저수준 기술자(LDD) 및 기능적 특징을 지원하며, ComParE 2016용 LLD 델타도 지원합니다.
- 간단한 Python API: 몇 줄의 코드로 오디오 파일에서 특징을 추출할 수 있습니다.
- 커뮤니티 확장: 커뮤니티에서 추가한 특징 세트도 사용 가능합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트