SamurAIGPT/Text-To-Video-AI
Generate video from text using AI
해결하는 문제
이 프로젝트는 간단한 텍스트 프롬프트에서 매력적인 단편 영상(예: YouTube Shorts, Instagram Reels, TikTok 등)을 자동으로 생성합니다. 스크립트 작성, 보이스오버 녹음, 배경 영상 찾기, 자막 동기화 등의 수작업을 모두 제거합니다.
작동 방식
이 시스템은 여러 AI 서비스를 조율하여 영상 전체를 엔드투엔드로 구축합니다:
- 스크립트 생성: 사용자가 제공한 주제를 바탕으로 LLM(OpenAI, Groq, Google Gemini 등)을 사용해 스크립트를 생성합니다.
- 보이스오버: EdgeTTS(무료) 또는 ElevenLabs를 사용해 스크립트를 음성으로 변환합니다.
- 비주얼: Pexels에서 관련 B-roll 영상을 가져오거나, MuAPI를 통해 AI 영상 세그먼트를 생성(Google Veo, Sora, Kling 등 모델 지원).
- 자막: Whisper 또는 Deepgram을 사용해 음성의 타임스탬프를 생성하여 동기화된 화면 내 텍스트를 만듭니다.
- 조립: 이 요소들을 조합해 세로 또는 가로 방향의 최종 영상 파일로 출력합니다.
대상 사용자
전문 편집 소프트웨어나 수동 자산 수집 없이 빠르게 고품질 AI 기반 영상 콘텐츠를 제작하고 싶은 콘텐츠 크리에이터, 소셜미디어 매니저, 교육자.
주요 특징
- 유연한 AI 스택: 여러 LLM 제공업체와 MuAPI를 통해 고급 영상 생성 모델을 지원.
- B-roll 통합: Pexels에서 스톡 영상을 자동으로 가져옵니다.
- 사용자 정의 스타일링: 자막 폰트, 색상, 위치를 완전히 제어 가능.
- 다양한 형식 지원: 9:16(세로) 및 16:9(가로) 방향을 모두 네이티브로 지원.
- 접근성 높은 진입: 로컬 설치, Google Colab, 또는 프로덕션 대응 프리미엄 API로 이용 가능.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트