jd-opensource/JoyAI-Video-Edit
一種利用自回歸擴散技術,在幀到達時即時編輯直播影片串流或上傳影片的系統。
NVlabs/LongLive
基於 NVFP4 的並行基礎設施,優化長影片生成的訓練與蒸餾,實現高吞吐、即時推論。
TheOrcDev/videorc
Videorc 是一個開源、AI 增強的桌面工作室,讓創作者能捕獲螢幕/攝影機,向多個平台串流,並自動生成功能字幕、標題、章節與亮點——所有操作皆透過單一的場景化介面完成。
WeChatCV/Wan-Alpha
一個影片生成框架,使用可平移的 RGB‑A 分佈學習器,實現高品質、透明度(alpha 通道)穩定的影片製作。
AlayaLab/AlayaWorld
結合空間與時間記憶的自回歸世界模型,支援即時相機控制,實現長時序、可互動、可播放的影片生成。
JayWebtech/autoshorts
一款本地優先的桌面應用,利用 AI 識別長影片或音訊中的爆紅瞬間,並自動裁剪為直式短片。
Robbyant/lingbot-video
專為具身智能設計的開源 MoE 視頻生成模型,旨在為機器人與物理世界理解生成具有物理合理性的視頻。
VelornLabs/velorn
一個開源 AI 影片工作台,透過 ComfyUI 與基於 MCP 的智能體自動化,將完整的時間軸編輯器與 AI 生成工作流程結合。
NVIDIA/flashdreams
一個用於互動式自回歸影片與世界模型的、高效能推理與服務庫,針對機器人與自動駕駛車輛的即時應用進行了優化。
shengshu-ai/minWM
一個全端開源框架,用於將文字轉影片基礎模型轉化為具備動作條件的即時影片世界模型。
ronak-create/FableCut
一個僅在瀏覽器中運行的非線性影片編輯器,其時間軸是一個 JSON 檔案,可由人類或 AI 代理透過 MCP、REST 或直接檔案寫入即時編輯。零 npm 依賴,可選 ffmpeg 用於快速匯出,內建 AI 背景移除功能。
amap-cvlab/ABot-World
ABot-World 是一個即時互動世界模擬器,可在單一桌面 GPU 上實現無限、行動條件化的影片生成。
cclank/lanshu-create-ai-presenter-video
一種通用的AI數位人影片製作工作流程,可將腳本與影像轉換為帶有字幕與特效的同步演示影片。
Netflix/vmaf
Netflix 開發的獲艾美獎感知影片品質評估工具,透過融合多項指標客觀衡量影片退化。
Anil-matcha/Open-AI-Micro-Drama-Generator
一個代理型AI流程,透過自動化故事開發、角色設計與影片製作,將簡單想法或腳本轉化為完整的電影級微戲劇影片。
ModelTC/Minimax-H3-Turbo
一組為 MiniMax-H3 設計的蒸餾 LoRA 檢查點,透過 Diffusers 與 ComfyUI 實現快速、少步數的影片與音訊生成。
vrgamegirl19/comfyui-vrgamedevgirl
一個包含 AI 影片建構器(用於分鏡式製作)、影片增強以及 AI 影片與音樂影片創作用 LoRA 訓練的 ComfyUI 自訂節點集合。
Agentchengfeng/chengfeng-videocut-skills
一個 Codex 插件安裝入口,提供 AI 代理透過 chengfeng-videocut 執行環境執行影片編輯所需的工具與方法。
Soul-AILab/SoulX-FlashTalk
SoulX-FlashTalk 是一個利用自校正雙向蒸餾技術,實現音訊驅動頭像連續即時無限串流的系統。
RafaelGodoyEbert/ViralCutter
一個開源的本地 AI 工具,可將長 YouTube 影片自動轉換為病毒式傳播的短影片,支援自動裁剪、動態字幕與人臉追蹤。
thu-ml/Causal-Forcing
使用因果 ODE 或因果一致性蒸餾的高品質即時互動式影片生成框架,支援高效少步自回歸擴散
SamurAIGPT/Seedance-2.5-API
一個 Python 封裝,適用於 ByteDance 的 Seedance 2.5 API,能夠啟用高保真 AI 影片的生成,具備先進的一致性角色和多模態參考支援。
huytranvan2010/AI-auto-generate-video
一個自動化流程,利用 AI 進行腳本生成與決定性 HTML 到影片的渲染,將越南語文字文章轉換為 9:16 的短影片。
shinkuan/Akagi
Akagi 是一個基於 Rust 的桌面助手,用於線上立直麻將(Mahjong Soul、Tenhou 等)。它透過 MITM 代理或 Chromium DevTools 擷取遊戲流量,運行內建神經網路機器人(以及可選的雲端推論模型)來計算數牌、待牌、和牌機率、對手風險與建議棄牌,並在可拖曳的 HUD 中顯示。已完成的對局會本地儲存,並在歷史記錄標籤頁中以段位圓餅圖、PT 趨勢線與詳細統計資料進行可視化。該應用以單一可攜式二進位檔形式提供,支援 Windows、macOS(Apple Silicon)與 Linux,使用 Tauri 2 + React 建構 UI,採用 Apache 2.0 授權。
Lightricks/ComfyUI-LTXVideo
一套擴展 LTX-2 影像生成模型功能的自訂 ComfyUI 節點與工作流程,支援 HDR 轉換、多語言配音與生成式上採樣。
BrokenSource/DepthFlow
DepthFlow 是一款開源的圖像轉影片轉換器,它利用深度估計與優化的著色器將靜態圖片轉換為 3D 視差動畫。
LeonQ8/ComfyUI-ALLinONE-MinimaxH3
一個統一的 ComfyUI 節點,透過將文字轉影片、影像轉影片及進階編輯工具整合至單一介面,簡化 MiniMax H3 影片流程。
WhatDreamsCost/WhatDreamsCost-ComfyUI
WhatDreamsCost‑ComfyUI 是一組自訂 ComfyUI 節點,為 AI 生成媒體工作流程添加影片與音訊編輯功能(時間軸編輯器、載入/裁剪節點、IC-LoRA 支援、音訊修復等)。
ItusiAI/Open-Magiviz
一個AI驅動的影片創作平台,可自動化從腳本生成、角色設計、分鏡創建到最終影片渲染的全流程。
NO6KIKO/gorest-2d-animation-spritesheet-generator
Gorest 是一個基於 Node 的、可在瀏覽器中執行的編輯器,可構建 2D 遊戲場景,產生或匯入精靈圖集,附加豐富的元資料,並預覽動畫——支援可選的 Codex 驅動提示。資源本地儲存,並包含用於轉盤式精靈的偽 3D 旋轉功能。
naqashafzal/AI-Content-Studio
一個自動化 AI 影片與播客生成器,可將長篇 YouTube 影片轉換為病毒式短影片,並從文字提示生成 AI 驅動的播客。
agan-j/xiaoniu
一款 AI 驅動的影片翻譯工具,能自動執行語音翻譯、聲音克隆與唇形同步,協助創作者將短劇與宣傳影片本地化,面向全球觀眾。
google-deepmind/tapnet
Google DeepMind 的 TAP‑Net 儲存庫為「Tracking Any Point」(任意點追蹤)任務提供數據集、預訓練模型(TAPIR, BootsTAPIR, TAPNext/Next++)、訓練程式碼以及 Colab/即時演示。該任務是一種精確的點級影片追蹤技術,對視覺研究與機器人模仿學習非常有用。
toki-plus/video-mover
一個從檔案監控、AI生成字幕到多平台瀏覽器自動化上傳的全自動影片分發流程。
mira-wm/mira
MIRA 是一個基於 50 億參數潛在擴散模型的 Rocket League 即時世界模型,可根據玩家操作模擬 2v2 比賽。
rediumvex/ai-video-generator-claude
為 Higgsfield 上的 Seedance 2.0 生成專業、電影級影片提示詞的 Claude 提示詞工程技能集。
SamurAIGPT/Text-To-Video-AI
一個由 AI 驅動的影片創作工具,可將文字提示轉換為包含腳本、旁白、B-roll 與同步字幕的完整編輯影片。
cclank/lanshu-awesome-ai-video-kit
一個包含 543 個經過測試的提示詞、支援 15 種模型以及官方端點自動化監控的全面性 AI 影片提示詞工程工具包。
hzwer/Practical-RIFE
RIFE 和 SAFA 的實用實現,用於視頻幀插值與增強,使使用者能提升視頻幀率以獲得更流暢的運動效果。
aigc-apps/VideoX-Fun
支援 CogVideoX-Fun 與 Wan 2.1 模型的影片生成流程,適用於文字、影像與影片到影片生成,具備高階結構與相機控制功能。
aqm857886159/Nomi
一個開源、本地優先的桌面工作台,用於 AI 影片製作,允許使用者結合多種生成來源與本地 ComfyUI,以降低製作成本。
SamurAIGPT/AI-Faceless-Video-Generator
一個自動化流水線,透過結合 GPT 腳本生成、文字轉語音和 SadTalker 臉部動畫,從主題生成口播影片。
showlab/Code2Video
一種以代理為基礎的框架,透過合成可執行的 Manim 程式碼而非像素,生成高品質教育影片,確保數學精確性與一致性。
james-see/ltx-video-mac
一款用於在 Apple Silicon 上進行本地 AI 影片生成的原生 SwiftUI macOS 應用程式,支援 LTX 和 MiniMax H3 模型,並整合音訊和配音工具。
NVlabs/rcm
一種用於蒸餾大型影片擴散模型的得分正則化連續時間一致性模型,可在 2–4 步內實現高品質、多樣化的影片生成。
bytedance/Bernini
Bernini 是一個統一的影片生成與編輯框架,結合了基於 MLLM 的語義規劃器與基於 DiT 的渲染器,以提升指令遵循能力與複雜的影片編輯效果。
nv-tlabs/omni-dreams
透過文本、高清地圖與軌跡位姿,為自動駕駛模擬即時生成逼真多鏡頭影片的世界模型。
Correr-Zhou/OmniShow
OmniShow 是一個統一文字、參考影像、音訊與姿態條件的多模態影片生成模型,可生成人類與物件互動的高保真影片。