linyqh/NarratoAI

利用 AI 大模型,一键解说并剪辑视频

解决的问题

NarratoAI 是一个用于制作电影和电视节目解说视频的一站式自动化工具。它消除了编写剧本、编辑视频剪辑、生成配音和添加字幕的人工工作,为创作者简化了整个内容创作流程。

工作原理

该工具使用大语言模型 (LLM) 来编写剧本并理解视频内容。它为流水线的不同阶段集成了各种 AI 引擎:

  • 剧本编写与分析:使用 LLM(如 DeepSeek R1/V3 或 Qwen2-VL)和视频理解后端(如 TwelveLabs Pegasus)来分析素材并生成解说剧本。
  • 音频:采用文本转语音 (TTS) 引擎(如 IndexTTS、OmniVoice 或腾讯云 TTS)进行配音,包括支持语音克隆。
  • 音频/音乐:集成 Sonilo AI,根据相同的视频内容和剪辑节奏生成背景音乐。
  • 音视频同步:自动化字幕和剪辑过程,支持导出到 CapCut 草稿。

适用对象

想要真正实现电影/电视节目回顾和短剧解说视频制作自动化的内容创作者、社交媒体影响者和视频编辑师。

亮点

  • 一站式流水线:在单个工作流中实现剧本编写、剪辑、配音和字幕的自动化。
  • 视频理解:支持 Qwen2-VL 和 TwelveLabs Pegasus 等高级模型进行原生视频分析。
  • 多模态 AI:结合 LLM、TTS 和 AI 生成音乐 (Sonilo AI),提供完整的视听体验。
  • 语音克隆:支持本地语音克隆引擎 (IndexTTS, OmniVoice) 以实现个性化音频。
  • 多模态集成:支持导出到 CapCut 草稿进行最后的后期润色。
  • 跨平台:提供 Windows 和 macOS (Apple Silicon) 的集成包。