jd-opensource/JoyAI-Video-Edit
フレームが到着するたびに、自己回帰拡散を用いてライブ動画ストリームまたはアップロードされた動画をリアルタイムで編集するシステム。
NVlabs/LongLive
NVFP4 を活用した並列インフラで、長時間動画生成のトレーニングと蒸留を最適化し、高スループットかつリアルタイム推論を可能にする。
TheOrcDev/videorc
Videorcは、オープンソースでAIを活用したデスクトップスタジオ。クリエイターがスクリーン/カメラをキャプチャし、複数のプラットフォームにストリーミングし、トランスクリプト、タイトル、チャプター、ハイライトをすべてAIで自動生成できる。すべてを1つのシーンベースUIから実行可能。
WeChatCV/Wan-Alpha
Shiftable RGB‑A Distribution Learner を使用し、安定した透過(アルファチャンネル)を持つ高品質動画の生成を可能にする動画生成フレームワーク。
AlayaLab/AlayaWorld
空間的記憶と時間的記憶を活用した自己回帰的世界モデルで、リアルタイムカメラ制御が可能な長時間再生可能な動画生成を実現。
JayWebtech/autoshorts
AI を活用して長時間の動画や音声からウイルス的瞬間を特定し、自動的に縦型短編クリップに切り出すローカル優先のデスクトップアプリ。
Robbyant/lingbot-video
身体的知能に特化したオープンソースのMoE動画生成モデル。ロボット工学や物理世界の理解に向け、物理的に合理的な動画を生成することを目的としています。
VelornLabs/velorn
ComfyUI と MCP ベースのエージェント自動化を介して、完全なタイムラインエディタと AI 生成ワークフローを統合したオープンソースAI動画ワークステーション。
NVIDIA/flashdreams
インタラクティブな自己回帰型ビデオおよびワールドモデルのための、高性能な推論およびサービングライブラリです。ロボティクスや自動運転車におけるリアルタイムアプリケーション向けに最適化されています。
shengshu-ai/minWM
テキストから動画を生成する基盤モデルを、アクション条件付きのリアルタイム動画世界モデルに変換するためのフルスタック・オープンソースフレームワーク。
ronak-create/FableCut
ブラウザ専用の非線形ビデオエディタ。タイムラインはAIエージェントがMCP、REST、または直接ファイル書き込みでリアルタイムに編集可能なJSONファイル。npm依存なし、高速エクスポート用にオプションのffmpeg、ブラウザ内AI背景除去機能を内蔵。
amap-cvlab/ABot-World
ABot-Worldは、単一のデスクトップGPU上で無限かつ行動条件付きの動画生成を実現するリアルタイムインタラクティブ世界シミュレータです。
cclank/lanshu-create-ai-presenter-video
スクリプトと画像を入力として、同期されたプレゼンター動画と字幕、効果を含むAIデジタル人間動画を生成する汎用的なワークフロー。
Netflix/vmaf
Netflixが開発したエミー賞受賞の視覚的動画品質評価ツール。複数のメトリクスを統合することで、動画劣化を客観的に測定する。
Anil-matcha/Open-AI-Micro-Drama-Generator
シンプルなアイデアやスクリプトを、物語の開発、キャラクター設計、動画制作を自動化することで、完全な映画的なマイクロドラマ動画に変換するエージェント型AIパイプライン。
ModelTC/Minimax-H3-Turbo
DiffusersおよびComfyUIを介して、高速で少数ステップで動画および音声生成を可能にするMiniMax-H3用の蒸留LoRAチェックポイントのコレクションです。
vrgamegirl19/comfyui-vrgamedevgirl
シーンごとの制作を可能にするAIビデオビルダー、動画強化、AIビデオおよび音楽ビデオ作成用のLoRAトレーニングを備えたComfyUIカスタムノードのコレクション。
Agentchengfeng/chengfeng-videocut-skills
chengfeng-videocutランタイムを介してビデオ編集を実行できるようにする、Codexプラグインのインストールエントリーポイントです。
Soul-AILab/SoulX-FlashTalk
SoulX-FlashTalk は、自己修正型双方向蒸留を用いて、継続的な会話ヘッドアニメーションをリアルタイムで無限にストリーミングするシステムです。
RafaelGodoyEbert/ViralCutter
長時間のYouTube動画を、AI駆動のクロッピングと動的キャプションで、インパクトのある短編クリップに自動変換するオープンソースでローカル実行可能なAIツール。
thu-ml/Causal-Forcing
因果ODEまたは因果一貫性蒸留を用いて、効率的な少数ステップ自己回帰拡散による高品質なリアルタイムインタラクティブ動画生成を実現するフレームワーク
SamurAIGPT/Seedance-2.5-API
SUMMARY: ByteDanceのSeedance 2.5 APIのPythonラッパーで、高度なキャラクターの一貫性とマルチモーダル参照サポートにより、高品質なAIビデオの生成を可能にします。
huytranvan2010/AI-auto-generate-video
AIによるスクリプト作成と決定論的HTMLから動画へのレンダリングを使用して、ベトナム語のテキスト記事を9:16のショートフォーム動画に自動変換するパイプライン。
shinkuan/Akagi
Akagi は、オンラインリーチ麻雀(Mahjong Soul、Tenhou など)用のRustベースのデスクトップアシスタントです。MITMプロキシまたはChromium DevToolsでゲーム通信をキャプチャし、組み込みのニューラルネットボット(およびオプションのクラウド推論モデル)でシャンテン、待ち、ツモ確率、相手のリスク、推奨捨て牌を計算し、ドラッグ可能なHUDで表示します。終了した対局はローカルに保存され、Historyタブでランク円グラフ、PTトレンドライン、詳細統計で可視化されます。Windows、macOS(Apple Silicon)、Linux用の単一ポータブルバイナリとして配布され、UIにはTauri 2 + Reactを使用し、Apache 2.0ライセンスです。
Lightricks/ComfyUI-LTXVideo
LTX-2動画生成モデルにHDR変換、多言語ダブイング、生成型アップスケーリングなどの機能を追加するカスタムComfyUIノードとワークフローのコレクション。
BrokenSource/DepthFlow
DepthFlowは、深度推定と最適化されたシェーダーを使用して、静止画を3Dパララックスアニメーションに変換するオープンソースの画像から動画へのコンバーターです。
LeonQ8/ComfyUI-ALLinONE-MinimaxH3
1つの統合ComfyUIノードで、MiniMax H3動画パイプラインのテキストから動画生成、画像から動画生成、高度な編集ツールを単一インターフェースに統合し、使いやすくする。
WhatDreamsCost/WhatDreamsCost-ComfyUI
WhatDreamsCost‑ComfyUIは、AI生成メディアワークフロー向けに、タイムラインエディタ、ロード/トリムノード、IC‑LoRAサポート、オーディオインペイントなど、動画および音声編集機能を追加するカスタムComfyUIノードのコレクションです。
ItusiAI/Open-Magiviz
スクリプト生成、キャラクター設計、ストーリーボード作成、最終的な動画レンダリングまでを自動化するAI駆動型の動画制作プラットフォーム。
NO6KIKO/gorest-2d-animation-spritesheet-generator
GorestはNodeベースで、ブラウザ上で動作するエディタであり、2Dゲームシーンの構築、スプライトシートの生成またはインポート、豊富なメタデータの付与、アニメーションのプレビューが可能。オプションでCodex駆動のプロンプトを利用。アセットはローカルに保存され、ターンテーブル風のフェイク3D回転機能も搭載。
naqashafzal/AI-Content-Studio
長編YouTube動画をバズるショート動画に変換し、テキストプロンプトからAI駆動ポッドキャストを生成する自動化AI動画・ポッドキャスト生成ツール。
agan-j/xiaoniu
AI 駆動の動画翻訳ツールで、音声翻訳、音声クローン、リップシンクを自動化し、クリエイターが短編ドラマやプロモーション動画をグローバルな視聴者向けにローカライズできるよう支援します。
google-deepmind/tapnet
Google DeepMindのTAP‑Netリポジトリは、「Tracking Any Point(任意の点の追跡)」タスクのためのデータセット、学習済みモデル(TAPIR, BootsTAPIR, TAPNext/Next++)、トレーニングコード、およびColab/リアルタイムデモを提供します。これはコンピュータビジョン研究やロボットの模倣学習に有用な、高精度なポイントレベルのビデオトラッキング技術です。
toki-plus/video-mover
ファイル監視とAI生成字幕から、ブラウザ自動化によるマルチプラットフォームアップロードまでを一貫して自動化する動画配信パイプライン。
mira-wm/mira
MIRAは、プレイヤーの行動に基づいて2v2マッチをシミュレートする50億パラメータの潜在拡散モデルを使用して、Rocket Leagueのリアルタイム世界モデルを実現しています。
rediumvex/ai-video-generator-claude
Higgsfield上のSeedance 2.0向けに、プロフェッショナルで映画のようなビデオプロンプトを生成するためのClaude用プロンプトエンジニアリングスキルのコレクション。
SamurAIGPT/Text-To-Video-AI
テキストプロンプトを完全編集済みの動画に変換するAI駆動の動画作成ツール。スクリプト、ボイスオーバー、B-roll、同期字幕をすべて含む。
cclank/lanshu-awesome-ai-video-kit
543個のテスト済みプロンプト、15種類のモデル対応、公式エンドポイントの自動監視機能により、プロンプト技術が常に最新の状態に保たれる、包括的なAIビデオプロンプトエンジニアリングキットです。
hzwer/Practical-RIFE
RIFE と SAFA の実用的な実装により、動画のフレーム補間と強化を可能にし、より滑らかな動きを実現するためのフレームレート向上をユーザーに提供します。
aigc-apps/VideoX-Fun
テキスト、画像、動画から動画への生成を可能にする CogVideoX-Fun および Wan 2.1 モデルをサポートする動画生成パイプライン。高度な構造制御およびカメラ制御を備える。
aqm857886159/Nomi
オープンソースでローカル優先のデスクトップワークベンチで、AI動画制作に複数の生成ソースとローカルのComfyUIを組み合わせ、制作コストを削減します。
SamurAIGPT/AI-Faceless-Video-Generator
GPTによる脚本生成、テキスト読み上げ、SadTalkerの顔アニメーションを組み合わせることで、トピックからトーキングヘッド動画を生成する自動化パイプライン。
showlab/Code2Video
実行可能なManimコードを合成することでピクセルではなく、数学的正確性と一貫性を保証する高品質な教育動画を生成するエージェントフレームワーク。
james-see/ltx-video-mac
Apple SiliconでのローカルAI動画生成に対応するネイティブSwiftUI macOSアプリ。統合された音声およびナレーションツールを備えたLTXおよびMiniMax H3モデルをサポートします。
NVlabs/rcm
大規模な動画拡散モデルを蒸留するためのスコア正則化連続時間一貫性モデル。2〜4ステップで高品質で多様な動画生成を実現。
bytedance/Bernini
Berniniは、MLLMベースのセマンティックプランナーとDiTベースのレンダラーを組み合わせ、指示への追従性と複雑なビデオ編集を実現する統合ビデオ生成・編集フレームワークです。
nv-tlabs/omni-dreams
テキスト、HDマップ、および軌跡ポーズを使用して、自動運転シミュレーション用のフォトリアルなマルチカメラビデオをリアルタイムで生成する世界モデル。
Correr-Zhou/OmniShow
OmniShowは、テキスト、参照画像、音声、ポーズの条件を統合して、人間が物体と相互作用する高精細な動画を生成するマルチモーダル動画生成モデルです。