ATH-MaaS/Pixelle-Video
🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine
解決的問題
Pixelle-Video 是一款自動化短影音引擎,允許使用者透過單一主題或關鍵字建立完整的影片。它消除了手動編寫劇本、圖像生成、配音合成和影片編輯的需求,讓完全沒有編輯經驗的人也能製作出具備專業感的短影音內容。
工作原理
該專案使用模組化流水線,透過四個主要階段將文本轉換為影片:
- 劇本生成:LLM(如 GPT、DeepSeek 或 Qwen)根據使用者的主題建立影片劇本。
- 視覺規劃:系統為劇本的每個片段規劃必要的圖像。
- 幀處理:AI 模型生成視覺資產。這可以透過 ComfyUI 工作流、RunningHub 或直接呼叫 OpenAI、DashScope 或 Kling AI 等提供商的 API 來完成圖像與影片生成。
- 影片合成:系統使用基於 HTML 的模板進行佈局與風格設計,將生成的視覺效果、合成語音(透過 Edge-TTS 或 Index-TTS 等 TTS 引擎)和背景音樂組合成最終影片。
適用對象
- 內容創作者:想要快速製作短影音而無需手動編輯的人。
- AI 愛好者:想要將各種 AI 模型(LLM、圖像/影片生成、TTS)整合進單一自動化工作流的使用者。
- 開發者:想要使用 ComfyUI 工作流或 HTML 模板來自定義影片生成流水線的人。
亮點
- 全自動化:透過單一提示詞生成劇本、圖像、影片和音訊。
- 靈活的模型整合:支援廣泛的 LLM(Ollama, GPT, DeepSeek)與媒體模型(Wan 2.1, Kling, DashScope)。
- 模組化架構:允許使用者更換 TTS 引擎、圖像生成器和影片模板。
- 多模態能力:包含數位人說話頭像、圖生影片(image-to-video)生成和動作遷移等進階模組。
- 可定制風格:為不同的影片方向(直向、橫向、方形)與視覺風格提供各種 HTML 模板。
相關
- 專案
- 專案
- 專案
- 專案
- 專案