SamurAIGPT/Text-To-Video-AI

Generate video from text using AI

What it solves

このプロジェクトは、シンプルなテキストトピックを完全な動画に変換する自動化パイプラインを提供し、手動での脚本作成、音声録音、映像収集の手間を省きます。YouTube Shorts、Instagram Reels、TikTok などのショートフォームコンテンツを作成するクリエイター向けに設計されています。

How it works

システムは複数の AI モデルをオーケストレーションし、エンドツーエンドで動画を構築します:

  1. Scripting: LLM(OpenAI、Groq、Google Gemini)を使用して、ユーザーのトピックに基づくスクリプトを生成します。
  2. Voiceover: EdgeTTS または ElevenLabs でスクリプトを音声に変換します。
  3. Visuals: Pexels から関連する B‑roll 映像を取得するか、Muapi API(Google Veo、Sora、Kling などのモデル対応)で AI 動画セグメントを生成します。
  4. Captions: Whisper または Deepgram を使用して、音声と同期したタイムスタンプ付き字幕を作成します。
  5. Composition: React/Remotion のコンポジションエンジンでこれらの要素を最終動画ファイルに結合します。

Who it’s for

高品質なナレーション動画を迅速に制作したいコンテンツクリエイター、教育者、ソーシャルメディアマネージャー向けです。プロの編集ソフトは不要です。

Highlights

  • Flexible AI Providers: 複数の LLM、TTS、STT プロバイダーに対応。
  • AI Video Integration: Muapi と統合し、最先端のテキスト‑トゥ‑ビデオモデルにアクセス。
  • Customizable Styling: 字幕フォント、カラー、動画の向き(縦横)をフルコントロール。
  • Multiple Deployment Options: ローカル、Google Colab、またはマネージド Premium API で実行可能。