High-Logic/Genie-TTS

GPT-SoVITS ONNX Inference Engine & Model Converter

해결하는 문제

GENIE는 고품질 텍스트 음성 합성(TTS)을 더 빠르고 접근하기 쉽게 만들기 위해 설계된 경량 추론 엔진으로, 특히 CPU 성능 최적화에 집중합니다. 기존 GPT-SoVITS 프로젝트의 무거운 의존성을 제거하여 강력한 GPU 없이도 거의 즉각적인 음성 생성을 가능하게 합니다.

작동 방식

GPT-SoVITS 프레임워크를 기반으로 구축된 GENIE는 기존 PyTorch 모델을 최적화된 ONNX 형식으로 변환합니다. 캐릭터 음성 모델 로드, 감정 및 억양 클로닝을 위한 참조 오디오 설정, 음성 생성을 위한 단순화된 Python API를 제공합니다. 또한 TTS 엔진을 API로 배포할 수 있는 내장 FastAPI 서버도 포함되어 있습니다.

대상 사용자

CPU 기반 시스템에서 대규모 모델 크기나 높은 지연 시간의 오버헤드 없이 고품질 다국어 TTS를 애플리케이션에 통합하고자 하는 개발자 및 크리에이터.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트