jd-opensource/JoyAI-Video-Edit

フレームが到着するたびに、自己回帰拡散を用いてライブ動画ストリームまたはアップロードされた動画をリアルタイムで編集するシステム。

NVlabs/LongLive

NVFP4 を活用した並列インフラで、長時間動画生成のトレーニングと蒸留を最適化し、高スループットかつリアルタイム推論を可能にする。

TheOrcDev/videorc

Videorcは、オープンソースでAIを活用したデスクトップスタジオ。クリエイターがスクリーン/カメラをキャプチャし、複数のプラットフォームにストリーミングし、トランスクリプト、タイトル、チャプター、ハイライトをすべてAIで自動生成できる。すべてを1つのシーンベースUIから実行可能。

WeChatCV/Wan-Alpha

Shiftable RGB‑A Distribution Learner を使用し、安定した透過(アルファチャンネル)を持つ高品質動画の生成を可能にする動画生成フレームワーク。

AlayaLab/AlayaWorld

空間的記憶と時間的記憶を活用した自己回帰的世界モデルで、リアルタイムカメラ制御が可能な長時間再生可能な動画生成を実現。

JayWebtech/autoshorts

AI を活用して長時間の動画や音声からウイルス的瞬間を特定し、自動的に縦型短編クリップに切り出すローカル優先のデスクトップアプリ。

Robbyant/lingbot-video

身体的知能に特化したオープンソースのMoE動画生成モデル。ロボット工学や物理世界の理解に向け、物理的に合理的な動画を生成することを目的としています。

VelornLabs/velorn

ComfyUI と MCP ベースのエージェント自動化を介して、完全なタイムラインエディタと AI 生成ワークフローを統合したオープンソースAI動画ワークステーション。

NVIDIA/flashdreams

インタラクティブな自己回帰型ビデオおよびワールドモデルのための、高性能な推論およびサービングライブラリです。ロボティクスや自動運転車におけるリアルタイムアプリケーション向けに最適化されています。

shengshu-ai/minWM

テキストから動画を生成する基盤モデルを、アクション条件付きのリアルタイム動画世界モデルに変換するためのフルスタック・オープンソースフレームワーク。

ronak-create/FableCut

ブラウザ専用の非線形ビデオエディタ。タイムラインはAIエージェントがMCP、REST、または直接ファイル書き込みでリアルタイムに編集可能なJSONファイル。npm依存なし、高速エクスポート用にオプションのffmpeg、ブラウザ内AI背景除去機能を内蔵。

amap-cvlab/ABot-World

ABot-Worldは、単一のデスクトップGPU上で無限かつ行動条件付きの動画生成を実現するリアルタイムインタラクティブ世界シミュレータです。

cclank/lanshu-create-ai-presenter-video

スクリプトと画像を入力として、同期されたプレゼンター動画と字幕、効果を含むAIデジタル人間動画を生成する汎用的なワークフロー。

Netflix/vmaf

Netflixが開発したエミー賞受賞の視覚的動画品質評価ツール。複数のメトリクスを統合することで、動画劣化を客観的に測定する。

Anil-matcha/Open-AI-Micro-Drama-Generator

シンプルなアイデアやスクリプトを、物語の開発、キャラクター設計、動画制作を自動化することで、完全な映画的なマイクロドラマ動画に変換するエージェント型AIパイプライン。

ModelTC/Minimax-H3-Turbo

DiffusersおよびComfyUIを介して、高速で少数ステップで動画および音声生成を可能にするMiniMax-H3用の蒸留LoRAチェックポイントのコレクションです。

vrgamegirl19/comfyui-vrgamedevgirl

シーンごとの制作を可能にするAIビデオビルダー、動画強化、AIビデオおよび音楽ビデオ作成用のLoRAトレーニングを備えたComfyUIカスタムノードのコレクション。

Agentchengfeng/chengfeng-videocut-skills

chengfeng-videocutランタイムを介してビデオ編集を実行できるようにする、Codexプラグインのインストールエントリーポイントです。

Soul-AILab/SoulX-FlashTalk

SoulX-FlashTalk は、自己修正型双方向蒸留を用いて、継続的な会話ヘッドアニメーションをリアルタイムで無限にストリーミングするシステムです。

RafaelGodoyEbert/ViralCutter

長時間のYouTube動画を、AI駆動のクロッピングと動的キャプションで、インパクトのある短編クリップに自動変換するオープンソースでローカル実行可能なAIツール。

thu-ml/Causal-Forcing

因果ODEまたは因果一貫性蒸留を用いて、効率的な少数ステップ自己回帰拡散による高品質なリアルタイムインタラクティブ動画生成を実現するフレームワーク

SamurAIGPT/Seedance-2.5-API

SUMMARY: ByteDanceのSeedance 2.5 APIのPythonラッパーで、高度なキャラクターの一貫性とマルチモーダル参照サポートにより、高品質なAIビデオの生成を可能にします。

huytranvan2010/AI-auto-generate-video

AIによるスクリプト作成と決定論的HTMLから動画へのレンダリングを使用して、ベトナム語のテキスト記事を9:16のショートフォーム動画に自動変換するパイプライン。

shinkuan/Akagi

Akagi は、オンラインリーチ麻雀(Mahjong Soul、Tenhou など)用のRustベースのデスクトップアシスタントです。MITMプロキシまたはChromium DevToolsでゲーム通信をキャプチャし、組み込みのニューラルネットボット(およびオプションのクラウド推論モデル)でシャンテン、待ち、ツモ確率、相手のリスク、推奨捨て牌を計算し、ドラッグ可能なHUDで表示します。終了した対局はローカルに保存され、Historyタブでランク円グラフ、PTトレンドライン、詳細統計で可視化されます。Windows、macOS(Apple Silicon)、Linux用の単一ポータブルバイナリとして配布され、UIにはTauri 2 + Reactを使用し、Apache 2.0ライセンスです。

Lightricks/ComfyUI-LTXVideo

LTX-2動画生成モデルにHDR変換、多言語ダブイング、生成型アップスケーリングなどの機能を追加するカスタムComfyUIノードとワークフローのコレクション。

BrokenSource/DepthFlow

DepthFlowは、深度推定と最適化されたシェーダーを使用して、静止画を3Dパララックスアニメーションに変換するオープンソースの画像から動画へのコンバーターです。

LeonQ8/ComfyUI-ALLinONE-MinimaxH3

1つの統合ComfyUIノードで、MiniMax H3動画パイプラインのテキストから動画生成、画像から動画生成、高度な編集ツールを単一インターフェースに統合し、使いやすくする。

WhatDreamsCost/WhatDreamsCost-ComfyUI

WhatDreamsCost‑ComfyUIは、AI生成メディアワークフロー向けに、タイムラインエディタ、ロード/トリムノード、IC‑LoRAサポート、オーディオインペイントなど、動画および音声編集機能を追加するカスタムComfyUIノードのコレクションです。

ItusiAI/Open-Magiviz

スクリプト生成、キャラクター設計、ストーリーボード作成、最終的な動画レンダリングまでを自動化するAI駆動型の動画制作プラットフォーム。

NO6KIKO/gorest-2d-animation-spritesheet-generator

GorestはNodeベースで、ブラウザ上で動作するエディタであり、2Dゲームシーンの構築、スプライトシートの生成またはインポート、豊富なメタデータの付与、アニメーションのプレビューが可能。オプションでCodex駆動のプロンプトを利用。アセットはローカルに保存され、ターンテーブル風のフェイク3D回転機能も搭載。

naqashafzal/AI-Content-Studio

長編YouTube動画をバズるショート動画に変換し、テキストプロンプトからAI駆動ポッドキャストを生成する自動化AI動画・ポッドキャスト生成ツール。

agan-j/xiaoniu

AI 駆動の動画翻訳ツールで、音声翻訳、音声クローン、リップシンクを自動化し、クリエイターが短編ドラマやプロモーション動画をグローバルな視聴者向けにローカライズできるよう支援します。

google-deepmind/tapnet

Google DeepMindのTAP‑Netリポジトリは、「Tracking Any Point(任意の点の追跡)」タスクのためのデータセット、学習済みモデル(TAPIR, BootsTAPIR, TAPNext/Next++)、トレーニングコード、およびColab/リアルタイムデモを提供します。これはコンピュータビジョン研究やロボットの模倣学習に有用な、高精度なポイントレベルのビデオトラッキング技術です。

toki-plus/video-mover

ファイル監視とAI生成字幕から、ブラウザ自動化によるマルチプラットフォームアップロードまでを一貫して自動化する動画配信パイプライン。

mira-wm/mira

MIRAは、プレイヤーの行動に基づいて2v2マッチをシミュレートする50億パラメータの潜在拡散モデルを使用して、Rocket Leagueのリアルタイム世界モデルを実現しています。

rediumvex/ai-video-generator-claude

Higgsfield上のSeedance 2.0向けに、プロフェッショナルで映画のようなビデオプロンプトを生成するためのClaude用プロンプトエンジニアリングスキルのコレクション。

SamurAIGPT/Text-To-Video-AI

テキストプロンプトを完全編集済みの動画に変換するAI駆動の動画作成ツール。スクリプト、ボイスオーバー、B-roll、同期字幕をすべて含む。

cclank/lanshu-awesome-ai-video-kit

543個のテスト済みプロンプト、15種類のモデル対応、公式エンドポイントの自動監視機能により、プロンプト技術が常に最新の状態に保たれる、包括的なAIビデオプロンプトエンジニアリングキットです。

hzwer/Practical-RIFE

RIFE と SAFA の実用的な実装により、動画のフレーム補間と強化を可能にし、より滑らかな動きを実現するためのフレームレート向上をユーザーに提供します。

aigc-apps/VideoX-Fun

テキスト、画像、動画から動画への生成を可能にする CogVideoX-Fun および Wan 2.1 モデルをサポートする動画生成パイプライン。高度な構造制御およびカメラ制御を備える。

aqm857886159/Nomi

オープンソースでローカル優先のデスクトップワークベンチで、AI動画制作に複数の生成ソースとローカルのComfyUIを組み合わせ、制作コストを削減します。

SamurAIGPT/AI-Faceless-Video-Generator

GPTによる脚本生成、テキスト読み上げ、SadTalkerの顔アニメーションを組み合わせることで、トピックからトーキングヘッド動画を生成する自動化パイプライン。

showlab/Code2Video

実行可能なManimコードを合成することでピクセルではなく、数学的正確性と一貫性を保証する高品質な教育動画を生成するエージェントフレームワーク。

james-see/ltx-video-mac

Apple SiliconでのローカルAI動画生成に対応するネイティブSwiftUI macOSアプリ。統合された音声およびナレーションツールを備えたLTXおよびMiniMax H3モデルをサポートします。

NVlabs/rcm

大規模な動画拡散モデルを蒸留するためのスコア正則化連続時間一貫性モデル。2〜4ステップで高品質で多様な動画生成を実現。

bytedance/Bernini

Berniniは、MLLMベースのセマンティックプランナーとDiTベースのレンダラーを組み合わせ、指示への追従性と複雑なビデオ編集を実現する統合ビデオ生成・編集フレームワークです。

nv-tlabs/omni-dreams

テキスト、HDマップ、および軌跡ポーズを使用して、自動運転シミュレーション用のフォトリアルなマルチカメラビデオをリアルタイムで生成する世界モデル。

Correr-Zhou/OmniShow

OmniShowは、テキスト、参照画像、音声、ポーズの条件を統合して、人間が物体と相互作用する高精細な動画を生成するマルチモーダル動画生成モデルです。