SamurAIGPT/Text-To-Video-AI
Generate video from text using AI
解决的问题
该项目将简单的文本提示自动转化为引人入胜的短视频(如 YouTube Shorts、Instagram Reels 和 TikTok),消除了编写脚本、录制旁白、寻找背景素材和同步字幕的手动工作。
如何工作
该系统协调多个 AI 服务,端到端地构建视频:
- 脚本生成:使用 LLM(OpenAI、Groq 或 Google Gemini)根据用户提供的主题生成脚本。
- 旁白:使用 EdgeTTS(免费)或 ElevenLabs 将脚本转换为语音。
- 视觉素材:从 Pexels 获取相关 B-roll 素材,或通过 MuAPI 生成 AI 视频片段(支持 Google Veo、Sora 和 Kling 等模型)。
- 字幕:使用 Whisper 或 Deepgram 生成语音的时间戳,创建同步的屏幕文字。
- 合成:将这些元素组合成最终的视频文件,支持竖屏或横屏格式。
适用人群
希望无需专业编辑软件或手动获取素材,快速制作高质量 AI 驱动视频内容的内容创作者、社交媒体经理和教育工作者。
主要亮点
- 灵活的 AI 技术栈:支持多种 LLM 提供商及通过 MuAPI 使用高端视频生成模型。
- B-roll 集成:自动从 Pexels 获取库存视频素材。
- 可自定义样式:完全控制字幕的字体、颜色和位置。
- 多格式支持:原生支持 9:16(竖屏)和 16:9(横屏)两种方向。
- 低门槛接入:可通过本地安装、Google Colab 或生产就绪的 Premium API 使用。
相关
- 项目
- 项目
- 项目
- 项目
- 项目