SamurAIGPT/Text-To-Video-AI

Generate video from text using AI

解决的问题

该项目将简单的文本提示自动转化为引人入胜的短视频(如 YouTube Shorts、Instagram Reels 和 TikTok),消除了编写脚本、录制旁白、寻找背景素材和同步字幕的手动工作。

如何工作

该系统协调多个 AI 服务,端到端地构建视频:

  1. 脚本生成:使用 LLM(OpenAI、Groq 或 Google Gemini)根据用户提供的主题生成脚本。
  2. 旁白:使用 EdgeTTS(免费)或 ElevenLabs 将脚本转换为语音。
  3. 视觉素材:从 Pexels 获取相关 B-roll 素材,或通过 MuAPI 生成 AI 视频片段(支持 Google Veo、Sora 和 Kling 等模型)。
  4. 字幕:使用 Whisper 或 Deepgram 生成语音的时间戳,创建同步的屏幕文字。
  5. 合成:将这些元素组合成最终的视频文件,支持竖屏或横屏格式。

适用人群

希望无需专业编辑软件或手动获取素材,快速制作高质量 AI 驱动视频内容的内容创作者、社交媒体经理和教育工作者。

主要亮点

  • 灵活的 AI 技术栈:支持多种 LLM 提供商及通过 MuAPI 使用高端视频生成模型。
  • B-roll 集成:自动从 Pexels 获取库存视频素材。
  • 可自定义样式:完全控制字幕的字体、颜色和位置。
  • 多格式支持:原生支持 9:16(竖屏)和 16:9(横屏)两种方向。
  • 低门槛接入:可通过本地安装、Google Colab 或生产就绪的 Premium API 使用。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目