xixihhhh/clipforge
ClipForgeは、1枚の製品画像(または短いテキストプロンプト)を、Douyin、Kuaishou、Xiaohongshu、TikTokなど向けの投稿用短い動画に変換するオープンソースAIツールです。スクリプト作成、ストーリーボード生成、画像から動画への合成、TTS、字幕、BGM、最終的なFFmpegでの合成を自動化します。2つの経路があります – 公開資産とEdge TTSを使用する完全無料のパス、および生成コンテンツの秒数に応じて課金される有料AI生成パス。ディレクター/ビギナーモード、ショット間の一貫性、選択的再生成、391種類のテンプレートライブラリ、ホットトピック自動生成、バッチ生産、組み込みコンプライアンス(AIGCラベル、広告法禁止語スキャン)、CLI/MCP/エージェント統合、AGPL-3.0ライセンスを備えています。EC販売者、マーケター、クリエイター、開発者が高速で低コストの製品動画を必要とする場合に最適です。
xhongc/ai_story
AI Storyは、スクリプト作成、ストーリーボード作成、画像生成、カメラワークの計画、および動画レンダリングに複数のAIモデルを使用し、ストーリープロンプトから完成したショート動画までの全工程を自動化する、Dockerベースのウェブアプリです。
nkxx188/ComfyUI-MiniMaxH3-Easy
MiniMax H3動画生成のための実用的なComfyUIノードスイートで、統合メディア管理とコンテキストセグメントによる長時間で一貫性のある動画生成を可能にします。
taco-group/SparkVSR
SparkVSRは、ユーザーが疎な高品質キーフレームを用いて復元プロセスをガイドできるインタラクティブな動画スーパーレゾリューションフレームワークであり、より良い時間的一貫性と制御可能な結果を確保します。
video-production-buddy/video-production-buddy
1回のプロンプト入力に頼るのではなく、計画、承認ゲート、検証済みレンダリングを含む管理されたワークフローで構成されるエージェント最優先のAI動画制作パイプライン
yizhi-chengzi/video-ai-talking
Alibaba Bailian VideoRetalkによるリップシンク、BailianまたはVolcengineのTTS、オプションのDeepSeekによるスクリプト生成、FFmpegによる最終レンダリングを用いて、静止した顔カメラ映像を完全な会話動画に変換するローカルWebアプリ。
LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler
Minimax H3用のカスタムComfyUIノードセット。VAEのラウンドトリップによるオーバーヘッドを回避しながら、ニューラル潜在変数アップスケーリングとタイル分割再サンプリングを提供し、高解像度ビデオ生成を加速させます。
Carasibana/ComfyUI-H3-FaceRefine
ComfyUI‑H3‑FaceRefineは、ComfyUI用のカスタムノードパックで、MiniMax H3の動画生成時に小さな顔のレンダリングを改善します。顔を検出し、より大きなキャンバスにクロップし、H3モデルで再処理してから元の動画に再結合します。自動・手動顔選択モード、ハードカット検出、フレームごとのノイズ除去、即時利用可能な例のワークフローを備えています。
pireel/pireel
Pireel Studioは、手動のタイムライン編集、チャットベースの説明、およびAIエージェントを組み合わせてビデオを作成できるオープンソースのAIビデオエディターです。
NikoDemon80/ComfyUI-H3-Motion-Context
MiniMax H3 用の ComfyUI 拡張で、潜在表現ベースの連続性を使用して、品質の低下や動き・音声のジャンプを防ぐことで、動画と音声のクリップをスムーズに連結できるようにします。
veedstudio/open-edit
自然言語の記述に基づいて、コードエージェントが音声認識、デザイン、MP4レンダリングを行うエージェント駆動型動画編集パイプライン。
KlingAIResearch/LivePortrait
駆動ビデオや画像を使用して、人間や動物の静止画に精密なステッチングとリターゲティング制御を伴うアニメーションを付与する、効率的なポートレートアニメーションツール。
Stonewuu/ai-fusion-video
スクリプト作成、ストーリーボード作成、AI画像/動画生成を統合した、エージェント駆動型の動画作成プラットフォーム。
MartinDelophy/ai-video-editor
Timeline Studioは、WebGPU/ONNX上で動作する、完全にブラウザ内に閉じたローカルファーストAI動画編集ツールです。メディアをアップロードせずに、多言語TTS、AI生成音楽、自動字幕、スマートフレーミング、透かし除去、ボーカル分離、デジタル人間アバターを提供します。プロジェクトはポータブルな `.timeline` ファイルとして保存され、豊富なUIまたはLLMエージェントが検査・計画・プログラム的に編集できるヘッドレスCLIスキルで編集可能です。コードはMITライセンス、モデル重みはHugging FaceとModelScopeにミラーリングされ、元のライセンスに従います。
lcy362/agnes-video-generator
クラウドAPIを使用してナレーションと字幕付きのマルチシーン動画を生成する、無料でオープンソースのAI動画生成ツール。高価なGPUやサブスクリプションの必要がありません。
Lightricks/LTX-Desktop
LTX Desktop は、LTX拡散モデルを使用して動画(および画像)の生成と編集ができるオープンソースのElectronアプリです。NVIDIA GPU(≥16 GB VRAM)またはApple Silicon Mac(≥15 GB 空きRAM)でローカル実行可能で、対応しないハードウェアでは有料クラウドAPI(LTX 2.5/2.3 Pro)に自動切り替えます。テキスト/画像/音声から動画、動画のリテイク/拡張、LoRAスタイルアダプター、Geminiによるプロンプト強化、タイムラインベースの動画エディタなどの機能を備えています。インストールはGitHubリリースのインストーラーから;アプリはOS固有のフォルダにデータを保存し、クラウドテキストエンコーディング用に無料のLTX APIキーが必要です。コードベース(Apache-2.0)はReact UI、Electronシェル、Python FastAPIバックエンドに分かれており、ローカルビルド用の完全な開発スクリプトがあります。オプションの匿名テレメトリは無効化可能です。
zai-org/SCAIL-2
SCAIL-2は、複雑な動きや多様なアイデンティティをサポートするために、中間ポーズ表現を必要としないエンドツーエンド型のキャラクターアニメーションおよび交換用オープンソースモデルです。
FireRedTeam/FireRed-OpenStoryline
自然言語プロンプトを通じて、スクリプト作成、メディア調達、編集を自動化する会話型AI動画作成ツール。
crisng95/flowkit
Flow Kit は Python‑FastAPI + Chrome 拡張機能システムで、Google Flow を介してリファレンス画像による視覚的一貫性、シーン生成、TTS、アップスケーリング、サムネイル作成、YouTube アップロードを含むエンドツーエンドの AI 動画作成を自動化します。
MeiGen-AI/OPSD-V
長期動画における誤差蓄積を低減し、運動ダイナミクスを向上させるための、後処理用のオンポリシー自己蒸留フレームワーク。
Robbyant/lingbot-world
リアルタイムのインタラクティブ性と長期的な時間的一貫性を備えた、高忠実度でインタラクティブなビデオ環境を生成するオープンソースの世界シミュレーター。
liyue-aigc/seedance-2-5-video-director
Dreamina/Jimeng Seedance 2.5向けの動画ディレクションスキルで、クリエイティブなアイデアと参照画像を構造化された動画スクリプトと最適化されたプロンプトに変換します。
nexu-io/html-video
ローカルコーディングエージェントとプラグイン可能なHTMLベースのレンダリングエンジンを使用して、テキスト、記事、またはGitHubリポジトリをアニメーションMP4ビデオに変換するためのメタレイヤー。
Tencent-Hunyuan/HunyuanVideo
HunyuanVideo は 130 億パラメータを超える大規模オープンソース動画基盤モデルで、優れたモーションとテキスト整合性を持つ高品質動画を生成します。
jnMetaCode/ai-shortfilm-prompts
2026年向けテキストから動画生成モデル用にカスタマイズされたAI動画プロンプトライブラリと、Claude Codeスキル。どんなアイデアも、すぐに実行可能なマルチショットプロンプトに変換。ジャンルテンプレート、カメラ移動ライブラリ、ネガティブプロンプトのプレファブ、インストール不要のウェブベースビルダー、5段階プロンプト構造の詳細ドキュメントを含む。
myccarl/ai-shortVideo-pipeline
myAiVideos は、Docker Compose を基盤としたオープンソースシステムで、中国語コンテンツ向けの短編動画作成ワークフロー(トピック → スクリプト → ビジュアル → オーディオ → 編集 → 配信)を完全自動化します。FastAPI オーケストレーターと Java Spring-Boot ゲートウェイ(認証、ルーティング、回路遮断、メータリング)を用い、DeepSeek、GLM、Kling、TTS サービスなど複数のLLMおよびマルチモーダルモデルと統合しています。パイプラインはレイヤード構造で、フェイルオーバー対応、Langfuse および Prometheus を通じた完全な観測性を備えています。
ModelTC/LightX2V
LightX2V は、高速な画像および動画生成(T2V、I2V、T2I、I2I、T2AVなど)のためのオープンソース推論フレームワークです。MiniMax-H3、Wan、HunyuanVideo、Qwen-Imageなど多数の最先端モデルをサポートし、4ステップ蒸留LoRA、FP8/NVFP4量子化、テンソル/シーケンス並列処理、幅広いハードウェアにおける分散デプロイといった高速化技術を提供します。H100 GPU上で競合フレームワークと比較して最大3.9倍の高速推論を実現。Dockerイメージ、pipインストール、Gradio/ComfyUIフロントエンド、豊富なドキュメント、オンラインデモを提供しています。
ChatCut-Inc/agent-plugin
AIコーディングアシスタント(Codex、Claude Code、Grok Bot、Cursor)が自然言語のプロンプトを通じてChatCutの動画プロジェクトを編集できるプラグインのコレクションです。メディアのインポート、グラフィックスの追加、音声の生成、文字起こし、エクスポートなどが可能です。ChatCutアカウントとサポート対象ホストのいずれかが必要です。認証はChatCutのMCPエンドポイントを通じて処理されます。
LingGuoAI/LingGuo-Drama
AIショートドラマおよび動画制作のためのオープンソースワークベンチで、原稿作成からアセット生成、最終動画合成までのパイプラインを管理します。
Rimagination/h3lite
MiniMax H3 用のローカルデプロイスキルで、Windows 上の低VRAM NVIDIA GPU がネイティブオーディオ付きで AI エージェントによる動画生成を可能にします。
jianjieyiban/JJYB_AI_VideoAutoCut
素材分析から脚本作成、ナレーション生成、音響同期まで、ワークフローを自動化するローカルファーストのAI動画制作ワークステーション。
ChenShuo2004/cs-board
cs-board は、中国語のテキスト、参照音声、およびオプションのスタイル/キャラクター画像を入力すると、完全にレンダリングされたホワイトボードスタイルのMP4に変換するローカル実行型AI動画制作ワークステーションです。音声クローン(IndexTTS経由)、スクリプト分割、AI生成イラスト、手書きアニメーション、字幕、音声・映像同期を処理し、12種類のビジュアルテンプレート、カスタムキャラクター/スタイル対応、動的インフォグラフィック、LANベースの協働キューを提供します。
zenstory-ai/video-recap-skills
AIを活用した動画要約システム。原始映像を自動的に動画理解、台本作成、ナレーション生成、編集まで行い、ナレーション付きの要約に変換します。
FujiwaraChoki/supoclip
長編動画をバズりやすい縦型クリップに自動変換するオープンソースでAI駆動の動画クリッピングツール。顔クロップ、字幕、バズ性スコアリングを自動で実行。
HITsz-TMG/VideoClaw
スクリプト作成、キャラクター設計、ストーリーボード作成、最終編集まで、クリエイティブな動画制作プロセス全体を自動化するAIディレクター系システム。
SandAI-org/MAGI-2-preview
テキストまたは画像プロンプトから、同期したサウンド付きの1080pビデオクリップを生成する114Bパラメータの統合オーディオ・ビデオ生成モデル。
TNTwise/REAL-Video-Enhancer
複数の GPU バックエンドをサポートし、さまざまな専門的なモデルを搭載した、AI ベースの動画フレーム補間および拡大に対応するクロスプラットフォーム GUI アプリケーション。
HKUDS/VideoAgent
自然言語プロンプトを通じて、創造的な動画の理解、編集、生成を行うオールインワンのエージェントフレームワーク。
OpenImagingLab/FlashVSR
FlashVSRは、超高解像度へのスケーラビリティと高速アップスケーリングを実現する、リアルタイム動画スーパーレゾリューション向けの1ステップストリーミング拡散フレームワークです。
pyang5166/gbro-collage-broll
短いナレーションラインを、三段階承認ワークフローと Gemini Omni Flash を使って、編集的なハーフトーン紙コラージュBロールアニメーションに変換するツールです。
pexoai/pexo-skills
テキスト、画像、またはURLを入力として、音楽と字幕付きの複数ショット動画にまで自動で変換する、オープンソースのエージェントスキルのセットです。
xiejunjie524/handdraw-story-video
手書きの線画から色付き画像へのアニメーション遷移を実現する、短い縦型ストーリービデオを作成するためのツール。
huangserva/ComfyUI_MiniMaxH3_Director
MiniMax H3 Director向けのComfyUIワークフロー集。テキストから動画、画像から動画、さらに参照素材を用いた高度な動画から動画への編集が可能です。
Vchitect/VBench
VBenchは、数十種類の品質ディメンション(技術的、美的、信頼性)にわたってビデオ生成モデルを自動的に評価するオープンソースのベンチマークスイートです。プロンプト集、メトリクスパイプライン、人間と一致するスコア、そしてT2V、I2V、長尺ビデオ、および本質的な忠実度の評価のための公開リーダーボードが含まれています。
Agents365-ai/video-podcast-maker
AIリサーチ、TTS音声、Remotionベースのビデオレンダリングを統合して、トピックからプロフェッショナルな4K動画ポッドキャストを自動生成するパイプライン。
twinnydotdev/twinny
Twinnyは、AI駆動のコード補完、インタラクティブなチャットサイドバー、埋め込みによるワークスペース全体のコンテキスト、およびオプションのP2P推論共有機能を追加する無料のVS Code拡張機能です。多くのLLMプロバイダー(OpenAI, Anthropic, Mistralなど)と連携し、ローカルで実行することも可能で、カスタマイズ可能なプロンプトやdiff view、コミットメッセージ生成、オフライン動作などの機能を提供します。
Anil-matcha/Open-AI-UGC
Arcads や MakeUGC の代替として、複数の最先端動画モデルを使用できる自己ホスティング可能なオープンソースAI動画広告スタジオ。
s1dashu/director
director は、言語モデルが動画制作の全プロセス(脚本、ビジュアルスタイル、キャラクター、ボイス、シーンごとのプロンプト)をガイドするAIエージェントスキルであり、LibTVまたは 即梦 CLIツールを使って編集可能な動画クリップを生成します。3つのモード(アニメーション解説、ストーリータイムアニメーション、映画ドラマ)をサポートし、Codexなどのエージェントにスキルディレクトリとしてインストールされます。