xixihhhh/clipforge

ClipForgeは、1枚の製品画像(または短いテキストプロンプト)を、Douyin、Kuaishou、Xiaohongshu、TikTokなど向けの投稿用短い動画に変換するオープンソースAIツールです。スクリプト作成、ストーリーボード生成、画像から動画への合成、TTS、字幕、BGM、最終的なFFmpegでの合成を自動化します。2つの経路があります – 公開資産とEdge TTSを使用する完全無料のパス、および生成コンテンツの秒数に応じて課金される有料AI生成パス。ディレクター/ビギナーモード、ショット間の一貫性、選択的再生成、391種類のテンプレートライブラリ、ホットトピック自動生成、バッチ生産、組み込みコンプライアンス(AIGCラベル、広告法禁止語スキャン)、CLI/MCP/エージェント統合、AGPL-3.0ライセンスを備えています。EC販売者、マーケター、クリエイター、開発者が高速で低コストの製品動画を必要とする場合に最適です。

xhongc/ai_story

AI Storyは、スクリプト作成、ストーリーボード作成、画像生成、カメラワークの計画、および動画レンダリングに複数のAIモデルを使用し、ストーリープロンプトから完成したショート動画までの全工程を自動化する、Dockerベースのウェブアプリです。

nkxx188/ComfyUI-MiniMaxH3-Easy

MiniMax H3動画生成のための実用的なComfyUIノードスイートで、統合メディア管理とコンテキストセグメントによる長時間で一貫性のある動画生成を可能にします。

taco-group/SparkVSR

SparkVSRは、ユーザーが疎な高品質キーフレームを用いて復元プロセスをガイドできるインタラクティブな動画スーパーレゾリューションフレームワークであり、より良い時間的一貫性と制御可能な結果を確保します。

video-production-buddy/video-production-buddy

1回のプロンプト入力に頼るのではなく、計画、承認ゲート、検証済みレンダリングを含む管理されたワークフローで構成されるエージェント最優先のAI動画制作パイプライン

yizhi-chengzi/video-ai-talking

Alibaba Bailian VideoRetalkによるリップシンク、BailianまたはVolcengineのTTS、オプションのDeepSeekによるスクリプト生成、FFmpegによる最終レンダリングを用いて、静止した顔カメラ映像を完全な会話動画に変換するローカルWebアプリ。

LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler

Minimax H3用のカスタムComfyUIノードセット。VAEのラウンドトリップによるオーバーヘッドを回避しながら、ニューラル潜在変数アップスケーリングとタイル分割再サンプリングを提供し、高解像度ビデオ生成を加速させます。

Carasibana/ComfyUI-H3-FaceRefine

ComfyUI‑H3‑FaceRefineは、ComfyUI用のカスタムノードパックで、MiniMax H3の動画生成時に小さな顔のレンダリングを改善します。顔を検出し、より大きなキャンバスにクロップし、H3モデルで再処理してから元の動画に再結合します。自動・手動顔選択モード、ハードカット検出、フレームごとのノイズ除去、即時利用可能な例のワークフローを備えています。

pireel/pireel

Pireel Studioは、手動のタイムライン編集、チャットベースの説明、およびAIエージェントを組み合わせてビデオを作成できるオープンソースのAIビデオエディターです。

NikoDemon80/ComfyUI-H3-Motion-Context

MiniMax H3 用の ComfyUI 拡張で、潜在表現ベースの連続性を使用して、品質の低下や動き・音声のジャンプを防ぐことで、動画と音声のクリップをスムーズに連結できるようにします。

veedstudio/open-edit

自然言語の記述に基づいて、コードエージェントが音声認識、デザイン、MP4レンダリングを行うエージェント駆動型動画編集パイプライン。

KlingAIResearch/LivePortrait

駆動ビデオや画像を使用して、人間や動物の静止画に精密なステッチングとリターゲティング制御を伴うアニメーションを付与する、効率的なポートレートアニメーションツール。

Stonewuu/ai-fusion-video

スクリプト作成、ストーリーボード作成、AI画像/動画生成を統合した、エージェント駆動型の動画作成プラットフォーム。

MartinDelophy/ai-video-editor

Timeline Studioは、WebGPU/ONNX上で動作する、完全にブラウザ内に閉じたローカルファーストAI動画編集ツールです。メディアをアップロードせずに、多言語TTS、AI生成音楽、自動字幕、スマートフレーミング、透かし除去、ボーカル分離、デジタル人間アバターを提供します。プロジェクトはポータブルな `.timeline` ファイルとして保存され、豊富なUIまたはLLMエージェントが検査・計画・プログラム的に編集できるヘッドレスCLIスキルで編集可能です。コードはMITライセンス、モデル重みはHugging FaceとModelScopeにミラーリングされ、元のライセンスに従います。

lcy362/agnes-video-generator

クラウドAPIを使用してナレーションと字幕付きのマルチシーン動画を生成する、無料でオープンソースのAI動画生成ツール。高価なGPUやサブスクリプションの必要がありません。

Lightricks/LTX-Desktop

LTX Desktop は、LTX拡散モデルを使用して動画(および画像)の生成と編集ができるオープンソースのElectronアプリです。NVIDIA GPU(≥16 GB VRAM)またはApple Silicon Mac(≥15 GB 空きRAM)でローカル実行可能で、対応しないハードウェアでは有料クラウドAPI(LTX 2.5/2.3 Pro)に自動切り替えます。テキスト/画像/音声から動画、動画のリテイク/拡張、LoRAスタイルアダプター、Geminiによるプロンプト強化、タイムラインベースの動画エディタなどの機能を備えています。インストールはGitHubリリースのインストーラーから;アプリはOS固有のフォルダにデータを保存し、クラウドテキストエンコーディング用に無料のLTX APIキーが必要です。コードベース(Apache-2.0)はReact UI、Electronシェル、Python FastAPIバックエンドに分かれており、ローカルビルド用の完全な開発スクリプトがあります。オプションの匿名テレメトリは無効化可能です。

zai-org/SCAIL-2

SCAIL-2は、複雑な動きや多様なアイデンティティをサポートするために、中間ポーズ表現を必要としないエンドツーエンド型のキャラクターアニメーションおよび交換用オープンソースモデルです。

FireRedTeam/FireRed-OpenStoryline

自然言語プロンプトを通じて、スクリプト作成、メディア調達、編集を自動化する会話型AI動画作成ツール。

crisng95/flowkit

Flow Kit は Python‑FastAPI + Chrome 拡張機能システムで、Google Flow を介してリファレンス画像による視覚的一貫性、シーン生成、TTS、アップスケーリング、サムネイル作成、YouTube アップロードを含むエンドツーエンドの AI 動画作成を自動化します。

MeiGen-AI/OPSD-V

長期動画における誤差蓄積を低減し、運動ダイナミクスを向上させるための、後処理用のオンポリシー自己蒸留フレームワーク。

Robbyant/lingbot-world

リアルタイムのインタラクティブ性と長期的な時間的一貫性を備えた、高忠実度でインタラクティブなビデオ環境を生成するオープンソースの世界シミュレーター。

liyue-aigc/seedance-2-5-video-director

Dreamina/Jimeng Seedance 2.5向けの動画ディレクションスキルで、クリエイティブなアイデアと参照画像を構造化された動画スクリプトと最適化されたプロンプトに変換します。

nexu-io/html-video

ローカルコーディングエージェントとプラグイン可能なHTMLベースのレンダリングエンジンを使用して、テキスト、記事、またはGitHubリポジトリをアニメーションMP4ビデオに変換するためのメタレイヤー。

Tencent-Hunyuan/HunyuanVideo

HunyuanVideo は 130 億パラメータを超える大規模オープンソース動画基盤モデルで、優れたモーションとテキスト整合性を持つ高品質動画を生成します。

jnMetaCode/ai-shortfilm-prompts

2026年向けテキストから動画生成モデル用にカスタマイズされたAI動画プロンプトライブラリと、Claude Codeスキル。どんなアイデアも、すぐに実行可能なマルチショットプロンプトに変換。ジャンルテンプレート、カメラ移動ライブラリ、ネガティブプロンプトのプレファブ、インストール不要のウェブベースビルダー、5段階プロンプト構造の詳細ドキュメントを含む。

myccarl/ai-shortVideo-pipeline

myAiVideos は、Docker Compose を基盤としたオープンソースシステムで、中国語コンテンツ向けの短編動画作成ワークフロー(トピック → スクリプト → ビジュアル → オーディオ → 編集 → 配信)を完全自動化します。FastAPI オーケストレーターと Java Spring-Boot ゲートウェイ(認証、ルーティング、回路遮断、メータリング)を用い、DeepSeek、GLM、Kling、TTS サービスなど複数のLLMおよびマルチモーダルモデルと統合しています。パイプラインはレイヤード構造で、フェイルオーバー対応、Langfuse および Prometheus を通じた完全な観測性を備えています。

ModelTC/LightX2V

LightX2V は、高速な画像および動画生成(T2V、I2V、T2I、I2I、T2AVなど)のためのオープンソース推論フレームワークです。MiniMax-H3、Wan、HunyuanVideo、Qwen-Imageなど多数の最先端モデルをサポートし、4ステップ蒸留LoRA、FP8/NVFP4量子化、テンソル/シーケンス並列処理、幅広いハードウェアにおける分散デプロイといった高速化技術を提供します。H100 GPU上で競合フレームワークと比較して最大3.9倍の高速推論を実現。Dockerイメージ、pipインストール、Gradio/ComfyUIフロントエンド、豊富なドキュメント、オンラインデモを提供しています。

ChatCut-Inc/agent-plugin

AIコーディングアシスタント(Codex、Claude Code、Grok Bot、Cursor)が自然言語のプロンプトを通じてChatCutの動画プロジェクトを編集できるプラグインのコレクションです。メディアのインポート、グラフィックスの追加、音声の生成、文字起こし、エクスポートなどが可能です。ChatCutアカウントとサポート対象ホストのいずれかが必要です。認証はChatCutのMCPエンドポイントを通じて処理されます。

LingGuoAI/LingGuo-Drama

AIショートドラマおよび動画制作のためのオープンソースワークベンチで、原稿作成からアセット生成、最終動画合成までのパイプラインを管理します。

Rimagination/h3lite

MiniMax H3 用のローカルデプロイスキルで、Windows 上の低VRAM NVIDIA GPU がネイティブオーディオ付きで AI エージェントによる動画生成を可能にします。

jianjieyiban/JJYB_AI_VideoAutoCut

素材分析から脚本作成、ナレーション生成、音響同期まで、ワークフローを自動化するローカルファーストのAI動画制作ワークステーション。

ChenShuo2004/cs-board

cs-board は、中国語のテキスト、参照音声、およびオプションのスタイル/キャラクター画像を入力すると、完全にレンダリングされたホワイトボードスタイルのMP4に変換するローカル実行型AI動画制作ワークステーションです。音声クローン(IndexTTS経由)、スクリプト分割、AI生成イラスト、手書きアニメーション、字幕、音声・映像同期を処理し、12種類のビジュアルテンプレート、カスタムキャラクター/スタイル対応、動的インフォグラフィック、LANベースの協働キューを提供します。

zenstory-ai/video-recap-skills

AIを活用した動画要約システム。原始映像を自動的に動画理解、台本作成、ナレーション生成、編集まで行い、ナレーション付きの要約に変換します。

FujiwaraChoki/supoclip

長編動画をバズりやすい縦型クリップに自動変換するオープンソースでAI駆動の動画クリッピングツール。顔クロップ、字幕、バズ性スコアリングを自動で実行。

HITsz-TMG/VideoClaw

スクリプト作成、キャラクター設計、ストーリーボード作成、最終編集まで、クリエイティブな動画制作プロセス全体を自動化するAIディレクター系システム。

SandAI-org/MAGI-2-preview

テキストまたは画像プロンプトから、同期したサウンド付きの1080pビデオクリップを生成する114Bパラメータの統合オーディオ・ビデオ生成モデル。

TNTwise/REAL-Video-Enhancer

複数の GPU バックエンドをサポートし、さまざまな専門的なモデルを搭載した、AI ベースの動画フレーム補間および拡大に対応するクロスプラットフォーム GUI アプリケーション。

HKUDS/VideoAgent

自然言語プロンプトを通じて、創造的な動画の理解、編集、生成を行うオールインワンのエージェントフレームワーク。

OpenImagingLab/FlashVSR

FlashVSRは、超高解像度へのスケーラビリティと高速アップスケーリングを実現する、リアルタイム動画スーパーレゾリューション向けの1ステップストリーミング拡散フレームワークです。

pyang5166/gbro-collage-broll

短いナレーションラインを、三段階承認ワークフローと Gemini Omni Flash を使って、編集的なハーフトーン紙コラージュBロールアニメーションに変換するツールです。

pexoai/pexo-skills

テキスト、画像、またはURLを入力として、音楽と字幕付きの複数ショット動画にまで自動で変換する、オープンソースのエージェントスキルのセットです。

xiejunjie524/handdraw-story-video

手書きの線画から色付き画像へのアニメーション遷移を実現する、短い縦型ストーリービデオを作成するためのツール。

huangserva/ComfyUI_MiniMaxH3_Director

MiniMax H3 Director向けのComfyUIワークフロー集。テキストから動画、画像から動画、さらに参照素材を用いた高度な動画から動画への編集が可能です。

Vchitect/VBench

VBenchは、数十種類の品質ディメンション(技術的、美的、信頼性)にわたってビデオ生成モデルを自動的に評価するオープンソースのベンチマークスイートです。プロンプト集、メトリクスパイプライン、人間と一致するスコア、そしてT2V、I2V、長尺ビデオ、および本質的な忠実度の評価のための公開リーダーボードが含まれています。

Agents365-ai/video-podcast-maker

AIリサーチ、TTS音声、Remotionベースのビデオレンダリングを統合して、トピックからプロフェッショナルな4K動画ポッドキャストを自動生成するパイプライン。

twinnydotdev/twinny

Twinnyは、AI駆動のコード補完、インタラクティブなチャットサイドバー、埋め込みによるワークスペース全体のコンテキスト、およびオプションのP2P推論共有機能を追加する無料のVS Code拡張機能です。多くのLLMプロバイダー(OpenAI, Anthropic, Mistralなど)と連携し、ローカルで実行することも可能で、カスタマイズ可能なプロンプトやdiff view、コミットメッセージ生成、オフライン動作などの機能を提供します。

Anil-matcha/Open-AI-UGC

Arcads や MakeUGC の代替として、複数の最先端動画モデルを使用できる自己ホスティング可能なオープンソースAI動画広告スタジオ。

s1dashu/director

director は、言語モデルが動画制作の全プロセス(脚本、ビジュアルスタイル、キャラクター、ボイス、シーンごとのプロンプト)をガイドするAIエージェントスキルであり、LibTVまたは 即梦 CLIツールを使って編集可能な動画クリップを生成します。3つのモード(アニメーション解説、ストーリータイムアニメーション、映画ドラマ)をサポートし、Codexなどのエージェントにスキルディレクトリとしてインストールされます。