xcLee001/SonicVale

一个开源的多角色、多情绪 AI 配音生成平台,支持小说、剧本、视频等内容的自动配音与导出。

해결하는 문제

SonicVale (음곡)은 소설, 스크립트, 비디오용 다중 캐릭터 및 다중 감정 음성 오버를 자동화하기 위해 설계되었습니다. 긴 형식의 콘텐츠에서 대사의 각 라인에 음성과 감정을 수동으로 할당하는 번거로움을 제거합니다.

작동 방식

이 플랫폼은 대규모 언어 모델(LLM)과 음성 합성(TTS) 엔진을 통합하여 텍스트를 오디오로 변환합니다. LLM을 사용해 대사를 자동으로 분할하고 역할을 할당하며, Index-TTS-2.0 엔진을 활용해 감정 표현이 풍부한 음성 합성을 수행합니다. 사용자는 텍스트를 가져오고, 캐릭터 음성 라이브러리를 관리하며, 특정 감정을 역할에 연결하고, 최종 결과를 내보내기 전에 정밀한 오디오 편집(예: 침묵 추가 또는 세그먼트 삭제)을 수행할 수 있습니다.

대상 사용자

다수의 캐릭터를 포함하는 서사 중심 콘텐츠에 고품질이고 감정 표현이 풍부한 AI 음성 오버가 필요한 콘텐츠 제작자, 작가, 영상 제작자.

주요 기능

  • 자동 대사 분할: 사용자 정의 프롬프트와 LLM을 사용해 스크립트를 캐릭터별 대사로 분할.
  • 다중 감정 지원: Index-TTS-2.0을 통합해 각 캐릭터에 세밀한 감정 톤 제공.
  • 캐릭터 관리: 여러 장에 걸쳐 일관된 음성 연결을 유지하기 위한 전용 역할 라이브러리.
  • 정밀한 오디오 편집: 수동으로 오디오 조각을 삭제하거나 침묵을 삽입해 리듬을 개선 가능.
  • 유연한 통합: OpenAI API 프로토콜과 호환되는 모든 LLM을 지원.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트