heygen-com/hyperframes
AIコーディングエージェントが動画制作を自動化できるように設計された、オープンソースのフレームワーク。HTML、CSS、シーク可能なアニメーションを入力として、決定論的なMP4動画を生成します。
harry0703/MoneyPrinterTurbo
テーマやキーワードを入力するだけで、スクリプト、ボイスオーバー、字幕、マッチング映像を含む完全な動画を自動生成するAI短編動画生成ツール。
calesthio/OpenMontage
テキストプロンプトからプロフェッショナルな動画を生成する、オープンソースでエージェント型の動画制作システム。研究、脚本作成、アセット生成、編集を自動化し、全体のパイプラインを自動化します。
browser-use/video-use
ユーザーがチャットを通じて原始的な映像を編集できるオープンソースのAI動画編集ツール。動画を構造化されたテキストとオンデマンドの視覚情報に変換し、LLMが処理できる形で提供します。
Vincentwei1021/video-shotcraft
AIエージェントスキルとして、Remotionを活用して製品のスクリーンショットとコピーから映画的なプロモーション動画を生成する。157のショットレシピカードのライブラリを用いる。
jub0t/Concat
Whisper と ffmpeg を活用した、ローカルで動作するオープンソースのビデオエディタ。CapCut の無料代替品として、自動字幕や音声合成といった内蔵 AI 機能を提供。
kaomei/stickman-video-director
テキストを構造化されたディレクター提案と、Gemini Omni Flashで一貫性のある1分間のスティッキーマンアニメーションを生成する最適化されたプロンプトに変換するCodexスキル。
Vincentwei1021/video-talkcraft
Remotion を通じて、スクリプトとボイスオーバーを、キャラクター単位のオーディオ同期と自動モーショングラフィックスを備えたプロフェッショナルなトークヘッド動画に変換する AI エージェントスキル。
samuelgursky/davinci-resolve-mcp
DaVinci Resolve MCPは、完全なDaVinci Resolve StudioスクリプティングAPIをJSON-over-HTTPサービスとして公開するオープンソースサーバーです。AIエージェントは高レベルのツール(プロジェクト作成、メディアインポート、タイムライン編集、グレーディング、Fusion、Fairlight、レンダリング設定など)を呼び出し、一貫した結果エンベロープを受信して安全で監査可能な自動化が可能になります。有料Studioエディションでは通常の外部スクリプトインターフェース経由で動作し、無料版にはLuaベースのブリッジが同梱されています。オプションのNodeベース「アドバンスド」サーバーは、Resolveを起動せずにResolveプロジェクトファイルを編集できます。このパッケージにはローカルブラウザコントロールパネルと多数のIDE統合が含まれており、オンプレミスのAIポストプロダクションアシスタントの実用的な基盤となっています。
diffusionstudio/editor
JSXをドキュメントソースとして使用するオープンソースのビデオエディタ。AIエージェントがコードでビデオ編集、モーショングラフィックス作成、メディア分析を行うことを可能にする専用CLIを備える。
ATH-MaaS/Pixelle-Video
単一のトピックからスクリプト、ビジュアル、ナレーションを生成し、手動の編集なしに完全な動画を作成するAI駆動の自動ショート動画エンジン。
AIMixer/ComfyUI_MiniMaxH3_Director
ComfyUI 用のプラグインで、MiniMax H3 用のディレクター・コンソールを提供し、マルチセグメント動画計画、同期音声生成、長編 AI 動画向けの高度なリファインツールを可能にします。
veedstudio/open-edit
コードエージェントを介して自然言語コマンドで映像編集、字幕の追加、モーショングラフィックスの作成が可能なエージェント駆動の動画編集パイプライン
fqscfqj/Y2A-Auto
Y2A‑Auto は自己ホスティング型の Python/Flask アプリで、YouTube 動画のダウンロード、Whisper/Voxtral + OpenAI を用いた字幕生成・翻訳、オプションで AI ベースの品質チェックとコンテンツモデレーション、再エンコード(CPU または GPU)、そして AcFun、Bilibili、または両方へのアップロードを自動化します。Web UI、YouTube チャンネル/キーワード監視、通知フック、CookieCloud 同期、セキュリティ機能を備え、Docker またはローカルで実行可能です。
Junchao-cs/SolarWM
短いトレーニングクリップから、長時間のカメラ制御可能なビデオ生成を可能にする、インタラクティブなビデオ・ワールドモデル構築のためのオープンソースの基盤。
OpenVDN/vdn-minimax-h3
VDN‑Minimax‑H3(VDN‑H3)は、MiniMax H3 をベースにしたハイブリッドアテンション動画拡散モデルです。軽量な線形アテンションブランチと LoRA アダプタを追加することで、768pの高解像度動画をニアリアルタイムで生成可能(例:単一B200 GPUで14秒のクリップを約11秒で生成)。リポジトリには4段階の学習レシピと、FP8およびFlashAttention‑4を活用した最適化された推論コード、詳細なセットアップ手順、性能表が含まれています。
cosmo-wander-ai/cosmo-edge
CosmoEdge 1.1 は、ビデオ分析およびビジョン言語モデル向けの Apache-2.0 C++ エッジ AI エンジンです。Sophon (BM1688/CV186X)、Rockchip (RK3576/RV1126B) NPU 上で動作し、Docker を介して x86/macOS でも実行可能です。ブラウザベースのパイプラインビルダー、REST/MQTT/WebSocket 統合、および商用モデル保護のための「Model Guard」を提供します。リポジトリには、デバイス固有のランタイムを構築するための Docker スクリプト、ベンチマークレポート、および詳細なドキュメントが含まれています。
0xsline/OpenChatCut
プロフェッショナルなマルチトラックタイムラインと会話型エージェントを組み合わせたオープンソースでローカルファーストのAIビデオエディタ。編集可能なエージェント駆動型の動画制作を実現。
Anil-matcha/AI-Youtube-Shorts-Generator
AI‑YouTube‑Shorts‑Generatorは、長編YouTube動画(またはローカルファイル)を、TikTok/Reels/YouTube Shorts用に最適化された縦型Shortクリップに自動変換するオープンソースのPythonツールです。動画をダウンロードし、Whisperで音声認識を行い、OpenAI、Gemini、またはMuAPIのモデルを使って『ウイルス的』になり得る瞬間をLLMでスコアリング。重複する候補を除外し、各ハイライトを9:16(または任意のアスペクト比)に自動クロップします。2つのモードを提供:ゼロセットアップのAPIモード(MuAPIにダウンロード・音声認識・スコアリング・クロップを委譲)と、`yt‑dlp`、`faster‑whisper`、OpenCV/ffmpeg、外部LLMをローカルで実行する完全ローカルモード。CLIはMP4ファイルに加え、各クリップのスコア、インパクトセリフ、理由を返却し、詳細なJSONファイルも出力可能。MITライセンス。クリエイター、広告代理店、開発者が自社のクリッピングSaaSを構築する際に最適です。
Alisa0808/vox-director
Voxスタイルのペーパーコラージュ風解説動画の制作を自動化し、スクリプトからキーフレーム、モーション、ナレーションまで全てを処理するエージェントスキル。
gnipbao/story-to-handdrawn-video
20種類の組み込みスタイルを持つ、物語のテキストや画像を縦長の手描きアニメーションに変換するツール。AIエージェントのスキルを通じて自動化可能。
gamedev-skills/awesome-gamedev-agent-skills
73のAIエージェント「スキル」(エンジン固有のコードガイド、分野、ジャンル、ワークフローのテンプレート)と、ゲームエンジンを自動検出し、必要な部分のみを読み込むルーターを備えたライブラリ。Claude、Cursor、Gemini-CLIなど、AIエージェントがオンデマンドでゲームコードを生成できるようにします。
Emily2040/seedance-2.0
AI動画生成用のエージェントスキルで、ざっくりとしたアイデアを意図的なプロンプトに変換し、ショット計画、リファレンスの紐付け、クリップ間の連続性を管理します。
yizhi-chengzi/video-ai-talking
Alibaba Bailian VideoRetalkによるリップシンク、BailianまたはVolcengineのTTS、オプションのDeepSeekによるスクリプト生成、FFmpegによる最終レンダリングを用いて、静止した顔カメラ映像を完全な会話動画に変換するローカルWebアプリ。
nkxx188/ComfyUI-MiniMaxH3-Easy
MiniMax H3 用のコンパクトな ComfyUI インターフェースで、テキストから動画、画像から動画、リファレンスベースの動画生成を、統合メディア入力システムで簡素化します。
AlayaLab/Evoke
外部の世界状態バンクを活用する3段階のCFGフリー世界モデルで、飛行中リプロンプトとカメラ制御を可能にし、無限に高品質な動画生成を実現します。
HKUDS/ViMax
ViMaxは、テキストアイデア、脚本、小説の抜粋を完全なAI生成動画に変換するオープンソースでエージェント駆動のフレームワークです。スクリプト作成、ストーリーボード作成、キャラクターの一貫性、最終レンダリングを、設定可能なLLM、画像、動画APIで処理します。ターミナルTUIまたはブラウザベースのWeb UIを使用可能。`uv sync`でインストールし、`configs/agent.local.yaml`でAPIキーを設定後、`vimax tui`または`npm run dev`でUIを起動します。
zhouxiaoka/autoclip
AI 駆動の動画クリッピングツールで、YouTube と Bilibili から自動的に動画をダウンロードし、LLM を使ってコンテンツを分析してハイライトを抽出し、ショートフォームのコレクションを生成します。
ArcReel/ArcReel
構造化された生成パイプラインを介して、脚本や小説を一貫性のあるショートビデオに変換する、オープンソースのセルフホスト型AIビデオ制作ワークベンチ。
xixihhhh/clipforge
ClipForgeは、1枚の製品画像(または短いテキストプロンプト)を、Douyin、Kuaishou、Xiaohongshu、TikTokなど向けの投稿用短い動画に変換するオープンソースAIツールです。スクリプト作成、ストーリーボード生成、画像から動画への合成、TTS、字幕、BGM、最終的なFFmpegでの合成を自動化します。2つの経路があります – 公開資産とEdge TTSを使用する完全無料のパス、および生成コンテンツの秒数に応じて課金される有料AI生成パス。ディレクター/ビギナーモード、ショット間の一貫性、選択的再生成、391種類のテンプレートライブラリ、ホットトピック自動生成、バッチ生産、組み込みコンプライアンス(AIGCラベル、広告法禁止語スキャン)、CLI/MCP/エージェント統合、AGPL-3.0ライセンスを備えています。EC販売者、マーケター、クリエイター、開発者が高速で低コストの製品動画を必要とする場合に最適です。
ChenShuo2004/cs-board
cs-board は、中国語のテキスト、参照音声、およびオプションのスタイル/キャラクター画像を入力すると、完全にレンダリングされたホワイトボードスタイルのMP4に変換するローカル実行型AI動画制作ワークステーションです。音声クローン(IndexTTS経由)、スクリプト分割、AI生成イラスト、手書きアニメーション、字幕、音声・映像同期を処理し、12種類のビジュアルテンプレート、カスタムキャラクター/スタイル対応、動的インフォグラフィック、LANベースの協働キューを提供します。
NikoDemon80/ComfyUI-H3-Motion-Context
MiniMax H3 用の ComfyUI 拡張で、潜在表現ベースの連続性を使用して、品質の低下や動き・音声のジャンプを防ぐことで、動画と音声のクリップをスムーズに連結できるようにします。
LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler
Minimax H3用のカスタムComfyUIノードセット。VAEのラウンドトリップによるオーバーヘッドを回避しながら、ニューラル潜在変数アップスケーリングとタイル分割再サンプリングを提供し、高解像度ビデオ生成を加速させます。
cartesiancs/cartcut
モーショングラフィックスとレイヤーベース編集に特化したAI搭載動画編集ツール。オートキャプション機能と高解像度レンダリングを提供。
GVCLab/PersonaLive
1枚の参照画像とドライブ動画から、無限長で表現力豊かなポートレートアニメーションをリアルタイムでストリーミング可能な拡散フレームワーク。
Carasibana/ComfyUI-H3-FaceRefine
ComfyUI用カスタムノードセットで、MiniMax H3動画における小さな顔の品質を、顔の検出・切り出し・再生成・元のクリップへの合成によって向上させる
xhongc/ai_story
AI Storyは、スクリプト作成、ストーリーボード作成、画像生成、カメラワークの計画、および動画レンダリングに複数のAIモデルを使用し、ストーリープロンプトから完成したショート動画までの全工程を自動化する、Dockerベースのウェブアプリです。
palmier-io/palmier-pro
タイムライン上でAIエージェントがコンテンツの作成と編集を直接行えるようにする、組み込み型生成AIとMCP対応のmacOS用ビデオエディタ。
nexu-io/html-video
ローカルコーディングエージェントとプラグイン可能なHTMLベースのレンダリングエンジンを使用して、テキスト、記事、またはGitHubリポジトリをアニメーションMP4ビデオに変換するためのメタレイヤー。
huangserva/ComfyUI_MiniMaxH3_Director
MiniMax H3 Director向けのComfyUIワークフロー集。テキストから動画、画像から動画、さらに参照素材を用いた高度な動画から動画への編集が可能です。
YILS-LIN/short-video-factory
テキストプロンプトと動画クリップから、AIを活用したデスクトップツールでプロダクトマーケティング用および一般コンテンツ用の短い動画を自動生成する
Huanshere/VideoLingo
AI を活用してプロフェッショナルな単一行字幕と高品質な音声オーバーレイを生成する、動画翻訳・ダブリングのワンストップツール。
hao-ai-lab/FastVideo
スパース蒸留とアテンションの最適化を通じて、ビデオ生成を加速させるために設計された、統一されたポストトレーニングおよびリアルタイム推論フレームワーク。
liangdabiao/Seedance2-Storyboard-Generator
Claude CodeとSeedance 2.0を活用したAI動画制作ワークフローで、物語を一貫性のある複数エピソードの動画シリーズに変換します。
lcy362/agnes-video-generator
高スペックGPUを必要とせず、クラウドAPIを活用してテキストまたは画像からナレーション付き、自動字幕付きのマルチシーン動画を生成する無料でオープンソースのAI動画生成ツールです。
jd-opensource/JoyAI-Video-Edit
フレームが到着するたびに、自己回帰拡散を用いてライブ動画ストリームまたはアップロードされた動画をリアルタイムで編集するシステム。
Stonewuu/ai-fusion-video
スクリプト作成、ストーリーボード作成、AI画像/動画生成を統合した、エージェント駆動型の動画作成プラットフォーム。
Lightricks/LTX-2
LTX-2は、テキストまたは画像プロンプトから高忠実度で同期されたオーディオとビデオを生成する、DiTベースのオーディオ・ビデオ基盤モデルです。