SamurAIGPT/Text-To-Video-AI

Generate video from text using AI

解決的問題

本專案可將簡單的文本提示自動轉換為引人入勝的短影片(如 YouTube Shorts、Instagram Reels 和 TikTok),消除撰寫腳本、錄製旁白、尋找背景影像與同步字幕的手動工作。

如何運作

此系統協調多項 AI 服務,端對端地建構影片:

  1. 腳本生成:使用 LLM(OpenAI、Groq 或 Google Gemini)根據使用者提供的主題生成腳本。
  2. 旁白:使用 EdgeTTS(免費)或 ElevenLabs 將腳本轉換為語音。
  3. 影像素材:從 Pexels 取得相關 B-roll 影像,或透過 MuAPI 生成 AI 影片片段(支援 Google Veo、Sora 和 Kling 等模型)。
  4. 字幕:使用 Whisper 或 Deepgram 產生語音的時間戳,創建同步的螢幕文字。
  5. 合成:將這些元素組合為最終的影片檔案,支援直式或橫式方向。

適用對象

希望無需專業編輯軟體或手動取得素材,快速製作高品質 AI 驅動影片內容的內容創作者、社群媒體經理與教育工作者。

主要特色

  • 彈性 AI 架構:支援多種 LLM 提供商及透過 MuAPI 使用高階影片生成模型。
  • B-roll 整合:自動從 Pexels 取得庫存影像素材。
  • 可自訂樣式:完全控制字幕的字型、顏色與位置。
  • 多格式支援:原生支援 9:16(直式)與 16:9(橫式)兩種方向。
  • 低門檻接入:可透過本機安裝、Google Colab 或生產就緒的 Premium API 使用。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案