linyqh/NarratoAI
利用 AI 大模型,一键解说并剪辑视频
解決的問題
NarratoAI 是一個用於製作電影與電視節目解說影片的一站式自動化工具。它消除了編寫劇本、編輯影片剪輯、生成配音與添加字幕的人工工作,為創作者簡化了整個內容創作流程。
工作原理
該工具使用大型語言模型 (LLM) 來編寫劇本並理解影片內容。它為流水線的不同階段整合了各種 AI 引擎:
- 劇本編寫與分析:使用 LLM(如 DeepSeek R1/V3 或 Qwen2-VL)與影片理解後端(如 TwelveLabs Pegasus)來分析素材並生成解說劇本。
- 音訊:採用文字轉語音 (TTS) 引擎(如 IndexTTS、OmniVoice 或騰訊雲 TTS)進行配音,包括支援語音複製。
- 音訊/音樂:整合 Sonilo AI,根據相同的影片內容與剪輯節奏生成背景音樂。
- 音訊/影片同步:自動化字幕與剪輯過程,支援匯出至 CapCut 草稿。
適用對象
想要真正實現電影/電視節目回顧與短劇解說影片製作自動化的內容創作者、社群媒體影響者與影片編輯師。
亮點
- 一站式流水線:在單一工作流中實現劇本編寫、剪輯、配音與字幕的自動化。
- 影片理解:支援 Qwen2-VL 與 TwelveLabs Pegasus 等高級模型進行原生影片分析。
- 多模態 AI:結合 LLM、TTS 與 AI 生成音樂 (Sonilo AI),提供完整的視聽體驗。
- 語音複製:支援本地語音複製引擎 (IndexTTS, OmniVoice) 以實現個性化音訊。
- 多模態整合:支援匯出至 CapCut 草稿進行最後的手動潤色。
- 跨平台:提供 Windows 與 macOS (Apple Silicon) 的整合套件。