MatteoFasulo/Whisper-TikTok

From AI tools to TikTok video creation using FFMPEG, Microsoft Edge read aloud and OpenAI Whisper model

해결하는 문제

Whisper-TikTok은 전사(transcription), 음성 해설, 시각적 조립을 결합하여 매력적인 TikTok 영상을 제작하는 과정을 자동화합니다. 수동 자막 작업과 로봇 같은 AI 음성의 필요성을 없애고, 더욱 자연스러운 청각적 경험을 제공합니다.

작동 방식

이 도구는 세 가지 핵심 기술을 통합합니다:

  1. OpenAI-Whisper (stable-ts를 통해)를 사용하여 오디오 파일에서 정확한 전사 데이터를 생성합니다.
  2. Microsoft Edge Cloud TTS API를 사용하여 고품질의 자연스러운 음성 해설을 생성합니다.
  3. FFMPEG를 사용하여 자막 및 배경 비주얼을 포함한 최종 영상을 조립합니다.

대상 사용자

각 클립을 수동으로 편집하지 않고도 정확한 캡션과 고품질 AI 음성이 포함된 TikTok 스타일의 영상을 빠르게 생성하고자 하는 콘텐츠 크리에이터.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트