linyqh/NarratoAI

利用 AI 大模型,一键解说并剪辑视频

무엇을 해결하는가

NarratoAI는 영화 및 TV 쇼 해설 영상을 제작하기 위한 원스톱 자동화 도구입니다. 스크립트 작성, 비디오 클립 편집, 음성 생성, 자막 추가와 같은 수동 작업을 제거하여 크리에이터를 위한 전체 콘텐츠 제작 프로세스를 간소화합니다.

작동 방식

이 도구는 대규모 언어 모델(LLMs)을 활용하여 비디오 제작 파이프라인의 창의적 및 기술적 측면을 처리합니다. 시각 능력을 갖춘 LLM(예: Qwen2-VL 또는 TwelveLabs Pegasus)을 사용하여 비디오 콘텐츠를 이해하고, 해당 이해를 바탕으로 스크립트를 생성하며, 편집, 음성 생성(다양한 TTS 엔진을 통해), 자막 동기화를 자동화합니다.

대상 사용자

전문적인 편집 기술 없이도 고품질의 영화/TV 해설 영상을 효율적으로 제작하고자 하는 콘텐츠 크리에이터 및 소셜 미디어 인플루언서.

주요 특징

  • 엔드 투 엔드 자동화: 하나의 워크플로우 내에서 스크립트 작성, 편집, 음성, 자막을 자동화합니다.
  • 비디오 이해: 심층적인 비디오 분석을 위해 Qwen2-VL 및 TwelveLabs Pegasus와 같은 고급 모델을 지원합니다.
  • 음성 복제: IndexTTS 및 OmniVoice를 포함한 여러 TTS 엔진을 통합하여 음성 복제 및 감정 제어를 지원합니다.
  • 유연한 배포: 클라우드 버전, Docker 컨테이너 또는 Windows 및 macOS용 로컬 설치 패키지로 사용할 수 있습니다.
  • 통합: 초안을 CapCut (剪映)으로 내보내는 것을 지원합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트