huytranvan2010/AI-auto-generate-video
Auto generate AI video with hyperframes
해결하는 문제
이 프로젝트는 텍스트 기사에서 9:16 비디오(틱톡, 샤프츠, 리얼스)를 자동으로 생성하는 방법을 제공합니다. 결정론적 파이프라인을 사용하여 스크립트를 정교한 비디오(내레이션 및 사운드 효과 포함)로 변환함으로써 수동 비디오 편집이 필요 없게 됩니다.
작동 방식
콘텐츠 생성을 두 부분으로 나눕니다: AI는 스크립트 및 템플릿 선택을 담당하고, 결정론적 코드는 실제 렌더링을 처리합니다.
- 스크립트 작성: Claude Code(또는 수동으로)를 사용하여 각 장면의 내레이션 텍스트와 특정 템플릿 ID를 포함하는
script.json을 생성합니다. - 오디오 생성: 파이프라인은 OmniVoice(로컬 TTS 엔진)를 사용하여 각 장면의 내레이션을 생성하고, 키워드나 장면 유형에 따라 사운드 효과(SFX)를 믹스합니다.
- 시각 렌더링: HyperFrames는 Chromium을 사용하여 HTML 기반 템플릿을 MP4 클립으로 렌더링합니다.
- 조립: FFmpeg가 클립을 연결하고 최종 오디오 트랙을 마스킹하여 1080x1920 비디오를 생성합니다.
대상 사용자
수동 편집 없이 베트남어 기사를 빠르게 쇼트폼 비디오로 변환하고 싶은 콘텐츠 크리에이터, 그리고 자동화된 비디오 제작 파이프라인에 관심이 있는 개발자.
주요 특징
- 결정론적 렌더링: 동일한 스크립트는 항상 동일한 비디오를 생성하므로 반복 작업이 쉬움.
- 코드 기반 템플릿: 시각 요소는 자체 포함형 HyperFrames 프로젝트로 관리되어 HTML/CSS로 쉽게 커스터마이징 가능.
- 자동 SFX: 스크립트 텍스트와 의미적 매칭에 기반해 사운드 효과가 자동으로 선택됨.
- 로컬 TTS: OmniVoice와 통합되어 외부 API 키 없이 로컬에서 베트남어 음성 합성 가능.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트