SamurAIGPT/Text-To-Video-AI

Generate video from text using AI

What it solves

이 프로젝트는 간단한 텍스트 주제를 완전한 비디오로 변환하는 자동화 파이프라인을 제공하여 수동 스크립트 작성, 보이스오버 녹음 및 영상 수집의 필요성을 없앱니다. YouTube Shorts, Instagram Reels, TikTok 등 짧은 형식의 콘텐츠를 만드는 크리에이터를 위해 설계되었습니다.

How it works

시스템은 여러 AI 모델을 오케스트레이션하여 엔드‑투‑엔드 비디오를 구축합니다:

  1. Scripting: LLM(OpenAI, Groq, Google Gemini)을 사용해 사용자의 주제에 기반한 스크립트를 생성합니다.
  2. Voiceover: EdgeTTS 또는 ElevenLabs를 이용해 스크립트를 음성으로 변환합니다.
  3. Visuals: Pexels에서 관련 B‑roll 영상을 가져오거나 Muapi API(Google Veo, Sora, Kling 등 모델 지원)를 통해 AI 비디오 세그먼트를 생성합니다.
  4. Captions: Whisper 또는 Deepgram을 사용해 오디오와 동기화된 타임스탬프 자막을 만듭니다.
  5. Composition: React/Remotion 합성 엔진을 사용해 이 요소들을 최종 비디오 파일로 결합합니다.

Who it’s for

고품질 내레이션 비디오를 빠르게 제작하고 싶지만 전문 편집 소프트웨어가 필요 없는 콘텐츠 크리에이터, 교육자, 소셜 미디어 매니저를 위한 솔루션입니다.

Highlights

  • Flexible AI Providers: 다수의 LLM, TTS, STT 제공자를 지원합니다.
  • AI Video Integration: Muapi와 통합해 최첨단 텍스트‑투‑비디오 모델에 접근합니다.
  • Customizable Styling: 자막 폰트, 색상 및 비디오 방향(세로 또는 가로)을 완전히 제어할 수 있습니다.
  • Multiple Deployment Options: 로컬 실행, Google Colab, 혹은 관리형 Premium API를 통해 사용할 수 있습니다.