SamurAIGPT/Text-To-Video-AI
Generate video from text using AI
解決的問題
本專案可將簡單的文本提示自動轉換為引人入勝的短影片(如 YouTube Shorts、Instagram Reels 和 TikTok),消除撰寫腳本、錄製旁白、尋找背景影像與同步字幕的手動工作。
如何運作
此系統協調多項 AI 服務,端對端地建構影片:
- 腳本生成:使用 LLM(OpenAI、Groq 或 Google Gemini)根據使用者提供的主題生成腳本。
- 旁白:使用 EdgeTTS(免費)或 ElevenLabs 將腳本轉換為語音。
- 影像素材:從 Pexels 取得相關 B-roll 影像,或透過 MuAPI 生成 AI 影片片段(支援 Google Veo、Sora 和 Kling 等模型)。
- 字幕:使用 Whisper 或 Deepgram 產生語音的時間戳,創建同步的螢幕文字。
- 合成:將這些元素組合為最終的影片檔案,支援直式或橫式方向。
適用對象
希望無需專業編輯軟體或手動取得素材,快速製作高品質 AI 驅動影片內容的內容創作者、社群媒體經理與教育工作者。
主要特色
- 彈性 AI 架構:支援多種 LLM 提供商及透過 MuAPI 使用高階影片生成模型。
- B-roll 整合:自動從 Pexels 取得庫存影像素材。
- 可自訂樣式:完全控制字幕的字型、顏色與位置。
- 多格式支援:原生支援 9:16(直式)與 16:9(橫式)兩種方向。
- 低門檻接入:可透過本機安裝、Google Colab 或生產就緒的 Premium API 使用。
相關
- 專案
- 專案
- 專案
- 專案
- 專案