jd-opensource/JoyAI-Video-Edit
프레임이 도착하는 즉시 자기회귀 확산을 사용하여 라이브 동영상 스트림 또는 업로드된 동영상을 실시간으로 편집하는 시스템입니다.
NVlabs/LongLive
NVFP4 기반의 병렬 인프라로 긴 동영상 생성의 학습과 증류를 최적화하고, 고처리량 실시간 추론을 가능하게 합니다.
TheOrcDev/videorc
Videorc는 오픈소스이며 AI를 활용한 데스크톱 스튜디오로, 크리에이터가 화면/카메라를 캡처하고 여러 플랫폼에 스트리밍하며, 트랜스크립트, 제목, 챕터, 하이라이트를 모두 하나의 시나리오 기반 UI에서 자동 생성할 수 있습니다.
WeChatCV/Wan-Alpha
Shiftable RGB‑A Distribution Learner 를 사용하여 안정적인 투명도(alpha 채널)를 갖는 고품질 비디오를 생성할 수 있는 비디오 생성 프레임워크.
AlayaLab/AlayaWorld
공간적 기억과 시간적 기억을 활용한 자기회귀 세계 모델로, 실시간 카메라 제어가 가능한 장시간 재생 가능한 동영상 생성을 가능하게 합니다.
JayWebtech/autoshorts
AI를 사용해 장시간 비디오나 오디오에서 유행할 만한 순간을 식별하고, 자동으로 세로형 단편 클립으로 자르는 로컬 우선 데스크톱 앱입니다.
Robbyant/lingbot-video
신체적 지능을 위한 오픈소스 MoE 동영상 생성 모델로, 로봇공학 및 물리 세계 이해를 위해 물리적으로 타당한 동영상을 생성하도록 설계되었습니다.
VelornLabs/velorn
ComfyUI와 MCP 기반 에이전트 자동화를 통해 완전한 타임라인 편집기와 AI 생성 워크플로우를 결합한 오픈소스 AI 비디오 워크스테이션입니다.
NVIDIA/flashdreams
대화형 자가회귀 비디오 및 월드 모델을 위한 고성능 추론 및 서빙 라이브러리이며, 로보틱스 및 자율 주행 차량의 실시간 응용 분야에 최적화되어 있습니다.
shengshu-ai/minWM
텍스트-투-비디오(T2V) 파운데이션 모델을 동작 조건부 실시간 비디오 세계 모델로 변환하기 위한 풀스택 오픈소스 프레임워크입니다.
ronak-create/FableCut
브라우저 전용 비선형 비디오 편집기. 타임라인은 인간 또는 AI 에이전트가 MCP, REST 또는 직접 파일 쓰기로 실시간으로 편집 가능한 JSON 파일. npm 종속성 없음, 빠른 내보내기를 위한 선택적 ffmpeg, 브라우저 내 AI 배경 제거 기능 포함.
amap-cvlab/ABot-World
ABot-World는 단일 데스크톱 GPU에서 무한하고 행동 조건부 동영상 생성을 실시간으로 가능하게 하는 세계 시뮬레이터입니다.
cclank/lanshu-create-ai-presenter-video
스크립트와 이미지를 입력으로 받아 동기화된 발표자 영상과 자막, 효과를 포함한 AI 디지털 인간 영상을 생성하는 일반화된 워크플로우입니다.
Netflix/vmaf
Netflix가 개발한 에미상 수상 시각적 동영상 품질 평가 도구로, 여러 메트릭의 융합을 통해 동영상 품질 저하를 객관적으로 측정한다.
Anil-matcha/Open-AI-Micro-Drama-Generator
간단한 아이디어나 스크립트를 스토리 개발, 캐릭터 디자인, 영상 제작을 자동화하여 완전한 영화적 마이크로 드라마 영상으로 변환하는 에이전트형 AI 파이프라인입니다.
ModelTC/Minimax-H3-Turbo
Diffusers 및 ComfyUI를 통해 빠르고 소수 단계로 동영상과 오디오 생성이 가능한 MiniMax-H3용 증류된 LoRA 체크포인트 모음입니다.
vrgamegirl19/comfyui-vrgamedevgirl
장면별 제작을 위한 AI 비디오 빌더, 비디오 강화, AI 영상 및 음악 영상 제작을 위한 LoRA 훈련을 포함하는 ComfyUI 커스텀 노드 모음.
Agentchengfeng/chengfeng-videocut-skills
chengfeng-videocut 런타임을 통해 비디오 편집을 수행할 수 있도록 하는 Codex 플러그인 설치 엔트리 포인트입니다.
Soul-AILab/SoulX-FlashTalk
SoulX-FlashTalk은 자기 수정형 양방향 증류를 사용하여 지속적인 음성 기반 대화 헤드 애니메이션을 실시간으로 무한 스트리밍하는 시스템입니다.
RafaelGodoyEbert/ViralCutter
긴 YouTube 영상을 AI 기반 크롭과 동적 자막으로 자동으로 확산형 짧은 클립으로 변환하는 오픈소스 로컬 AI 도구.
thu-ml/Causal-Forcing
인과 ODE 또는 인과 일관성 증류를 사용하여 효율적인 소수 단계 자기회귀 확산을 가능하게 하는 고품질 실시간 인터랙티브 동영상 생성 프레임워크
SamurAIGPT/Seedance-2.5-API
ByteDance의 Seedance 2.5 API용 Python 래퍼로, 고급 캐릭터 일관성과 멀티모달 참조 지원을 통해 고충실도 AI 비디오 생성을 가능하게 합니다.
huytranvan2010/AI-auto-generate-video
AI를 통한 스크립트 생성과 결정론적 HTML에서 비디오로의 렌더링을 사용하여 베트남어 텍스트 기사를 9:16 쇼트폼 동영상으로 자동 변환하는 자동화된 파이프라인.
shinkuan/Akagi
Akagi는 온라인 리치 마작(Mahjong Soul, Tenhou 등)용 Rust 기반 데스크톱 보조 도구입니다. MITM 프록시 또는 Chromium DevTools를 통해 게임 트래픽을 캡처하고, 내장된 신경망 봇(및 선택적 클라우드 추론 모델)을 사용해 선텐, 대기, 승리 확률, 상대 위험도, 추천 버림을 계산하며, 드래그 가능한 HUD에 표시합니다. 완료된 게임은 로컬에 저장되어 히스토리 탭에서 랭크 원형 차트, PT 추세선, 상세 통계로 시각화됩니다. Windows, macOS(Apple Silicon), Linux용 단일 포터블 바이너리로 배포되며, UI는 Tauri 2 + React를 사용하고 Apache 2.0 라이선스입니다.
Lightricks/ComfyUI-LTXVideo
HDR 변환, 다국어 더빙, 생성형 업스케일링 등의 기능을 통해 LTX-2 동영상 생성 모델을 확장하는 커스텀 ComfyUI 노드 및 워크플로우 모음.
BrokenSource/DepthFlow
DepthFlow는 깊이 추정 및 최적화된 셰이더를 사용하여 정지 영상을 3D 패럴랙스 애니메이션으로 변환하는 오픈 소스 이미지-비디오 변환기입니다.
LeonQ8/ComfyUI-ALLinONE-MinimaxH3
텍스트에서 비디오 생성, 이미지에서 비디오 생성, 고급 편집 도구를 하나의 인터페이스로 통합하여 ComfyUI 노드를 단일화한 MiniMax H3 비디오 파이프라인을 간소화합니다.
WhatDreamsCost/WhatDreamsCost-ComfyUI
WhatDreamsCost‑ComfyUI는 AI 생성 미디어 워크플로우를 위한 비디오 및 오디오 편집 기능(타임라인 에디터, 로드/트림 노드, IC-LoRA 지원, 오디오 인페인팅 등)을 추가하는 사용자 정의 ComfyUI 노드 모음입니다.
ItusiAI/Open-Magiviz
스크립트 생성, 캐릭터 디자인, 스토리보드 생성, 최종 영상 렌더링까지를 자동화하는 AI 기반 영상 제작 플랫폼.
NO6KIKO/gorest-2d-animation-spritesheet-generator
Gorest는 Node 기반의 브라우저 실행형 에디터로, 2D 게임 장면을 구성하고 스프라이트시트를 생성하거나 가져오며 풍부한 메타데이터를 첨부하고 애니메이션을 미리보기할 수 있습니다. 선택적으로 Codex 기반 프롬프트를 사용할 수 있으며, 자산은 로컬에 저장되며 타이머 스타일의 가짜 3D 회전 기능도 제공합니다.
naqashafzal/AI-Content-Studio
긴 형식의 유튜브 영상을 바이럴 쇼트로 변환하고, 텍스트 프롬프트에서 AI 기반 포드캐스트를 생성하는 자동화된 AI 영상 및 포드캐스트 생성기
agan-j/xiaoniu
AI 기반 비디오 번역 도구로, 음성 번역, 음성 클로닝, 립싱크를 자동화하여 크리에이터가 짧은 드라마와 홍보 영상을 전 세계 시청자를 위해 현지화할 수 있도록 돕습니다.
google-deepmind/tapnet
Google DeepMind의 TAP‑Net 저장소는 “Tracking Any Point” 작업(컴퓨터 비전 연구 및 로봇 모방 학습에 유용한 정밀 포인트 레벨 비디오 트래킹)을 위한 데이터셋, 사전 학습된 모델(TAPIR, BootsTAPIR, TAPNext/Next++), 학습 코드 및 Colab/실시간 데모를 제공합니다.
toki-plus/video-mover
파일 모니터링과 AI 생성 자막부터 브라우저 자동화를 통한 다중 플랫폼 업로드까지 모든 과정을 자동화하는 동영상 배포 파이프라인.
mira-wm/mira
MIRA는 플레이어의 행동에 기반하여 2v2 매치를 시뮬레이션하는 50억 파라미터 잠재 확산 모델을 사용하여 Rocket League의 실시간 세계 모델을 구현합니다.
rediumvex/ai-video-generator-claude
Higgsfield의 Seedance 2.0을 위해 전문적이고 영화적인 비디오 프롬프트를 생성하는 Claude용 프롬프트 엔지니어링 기술 모음.
SamurAIGPT/Text-To-Video-AI
텍스트 프롬프트를 스크립트, 보이스오버, B-roll, 동기화 자막이 포함된 완전히 편집된 영상으로 변환하는 AI 기반 동영상 제작 도구.
cclank/lanshu-awesome-ai-video-kit
543개의 테스트된 프롬프트, 15개의 지원 모델, 그리고 공식 엔드포인트의 자동 모니터링을 통해 프롬프트 기술이 최신 상태를 유지하도록 보장하는 종합적인 AI 비디오 프롬프트 엔지니어링 키트입니다.
hzwer/Practical-RIFE
RIFE와 SAFA의 실용적인 구현을 통해 사용자가 동영상 프레임 속도를 높이고 더 부드러운 움직임을 얻을 수 있도록 하는 동영상 프레임 보간 및 강화 도구입니다.
aigc-apps/VideoX-Fun
텍스트, 이미지, 동영상에서 동영상 생성을 지원하는 CogVideoX-Fun 및 Wan 2.1 모델을 활용하는 동영상 생성 파이프라인. 고도의 구조적 제어 및 카메라 제어 기능을 제공.
aqm857886159/Nomi
오픈소스이자 로컬 우선의 데스크톱 워크벤치로, AI 비디오 제작 시 여러 생성 소스와 로컬 ComfyUI를 결합하여 제작 비용을 낮춥니다.
SamurAIGPT/AI-Faceless-Video-Generator
GPT 스크립트 생성, 텍스트 음성 변환, SadTalker 얼굴 애니메이션을 결합하여 주제에서 말하는 헤드 비디오를 생성하는 자동화 파이프라인.
showlab/Code2Video
실행 가능한 Manim 코드를 합성함으로써 픽셀이 아닌 수학적 정확성과 일관성을 보장하는 고품질 교육용 동영상을 생성하는 에이전트 기반 프레임워크입니다.
james-see/ltx-video-mac
Apple Silicon에서 로컬 AI 영상 생성을 지원하는 네이티브 SwiftUI macOS 앱으로, 통합 오디오 및 내레이션 도구를 갖춘 LTX 및 MiniMax H3 모델을 지원합니다.
NVlabs/rcm
대규모 동영상 확산 모델을 증류하기 위한 스코어 정규화 연속 시간 일관성 모델로, 2~4단계에서 고품질이고 다양한 동영상 생성이 가능합니다.
bytedance/Bernini
Bernini는 MLLM 기반의 시맨틱 플래너와 DiT 기반의 렌더러를 결합하여, 지시어 준수 능력과 복잡한 비디오 편집 기능을 향상시킨 통합 비디오 생성 및 편집 프레임워크입니다.
nv-tlabs/omni-dreams
텍스트, HD 맵 및 궤적 포즈를 사용하여 자율 주행 시뮬레이션을 위한 실사 멀티 카메라 비디오를 실시간으로 생성하는 월드 모델입니다.
Correr-Zhou/OmniShow
OmniShow는 텍스트, 참조 이미지, 오디오, 자세 조건을 통합하여 인간이 물체와 상호작용하는 고해상도 영상을 생성하는 다중 모달 영상 생성 모델입니다.