SamurAIGPT/Text-To-Video-AI

Generate video from text using AI

解決する課題

このプロジェクトは、シンプルなテキストプロンプトから魅力的なショートフォーム動画(YouTube Shorts、Instagram Reels、TikTokなど)の作成を自動化します。スクリプトの作成、ボイスオーバーの録音、バックグラウンド映像の探求、字幕の同期といった手作業をすべて排除します。

動作方法

このシステムは、複数のAIサービスを調整して、動画をエンドツーエンドで構築します:

  1. スクリプト作成:ユーザーが提供するトピックに基づき、LLM(OpenAI、Groq、Google Geminiなど)を使用してスクリプトを生成します。
  2. ボイスオーバー:EdgeTTS(無料)またはElevenLabsを使用して、スクリプトを音声に変換します。
  3. ビジュアル:Pexelsから関連するB-roll映像を取得するか、MuAPIを介してAI動画セグメントを生成(Google Veo、Sora、Klingなどのモデルをサポート)。
  4. 字幕:WhisperまたはDeepgramを使用して音声のタイムスタンプを生成し、同期された画面内テキストを作成します。
  5. 統合:これらの要素を組み合わせ、縦型または横型の最終動画ファイルとして出力します。

対象ユーザー

プロの編集ソフトウェアや手動でのアセット調達なしに、迅速に高品質なAI駆動動画コンテンツを制作したいコンテンツクリエイター、SNSマネージャー、教育者。

特徴

  • 柔軟なAIスタック:複数のLLMプロバイダーと、MuAPIを介したハイエンド動画生成モデルをサポート。
  • B-roll統合:Pexelsからストック映像を自動取得。
  • カスタマイズ可能なスタイル:字幕のフォント、色、位置を完全に制御可能。
  • 複数フォーマット対応:9:16(縦型)および16:9(横型)の両方をネイティブサポート。
  • アクセスしやすい導入:ローカルインストール、Google Colab、またはプロダクション対応のプレミアムAPIから利用可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト