heygen-com/hyperframes
AI 코딩 에이전트가 비디오 제작을 자동화할 수 있도록 설계된 오픈소스 프레임워크로, HTML, CSS, 탐색 가능한 애니메이션을 입력으로 하여 결정론적 MP4 동영상을 생성합니다.
harry0703/MoneyPrinterTurbo
주제나 키워드를 입력하면 스크립트, 보이스오버, 자막, 매칭된 영상까지 포함한 완전한 영상을 자동으로 생성하는 AI 단편 영상 생성 도구.
calesthio/OpenMontage
텍스트 프롬프트에서 프로페셔널한 영상까지 자동화하는 오픈소스 에이전트형 영상 제작 시스템. 연구, 스크립트 작성, 자산 생성, 편집을 자동화하여 전체 파이프라인을 처리합니다.
browser-use/video-use
사용자가 채팅을 통해 원본 영상을 편집할 수 있는 오픈소스 AI 동영상 편집 도구. 동영상을 구조화된 텍스트와 필요 시 시각 정보로 변환하여 LLM이 처리할 수 있도록 합니다.
Vincentwei1021/video-shotcraft
AI 에이전트 스킬로 Remotion을 사용해 제품 스크린샷과 텍스트를 기반으로 영화적 프로모션 영상을 생성하며, 157개의 샷 레시피 카드 라이브러리를 활용합니다.
jub0t/Concat
Whisper와 ffmpeg를 활용한 로컬에서 작동하는 오픈소스 비디오 에디터. CapCut의 무료 대안으로, 자동 자막과 텍스트 음성 변환과 같은 내장 AI 기능을 제공합니다.
kaomei/stickman-video-director
텍스트를 구조화된 디렉터 제안서와 Gemini Omni Flash로 일관된 1분짜리 스틱맨 애니메이션을 생성할 수 있도록 최적화된 프롬프트로 변환하는 Codex 스킬입니다.
Vincentwei1021/video-talkcraft
Remotion을 통해 스크립트와 보이스오버를 캐릭터 수준 오디오 동기화와 자동 모션 그래픽을 갖춘 프로페셔널한 타이핑 헤드 영상으로 변환하는 AI 에이전트 스킬입니다.
samuelgursky/davinci-resolve-mcp
DaVinci Resolve MCP는 완전한 DaVinci Resolve Studio 스크립팅 API를 JSON-Over-HTTP 서비스로 노출하는 오픈소스 서버입니다. AI 에이전트는 프로젝트 생성, 미디어 가져오기, 타임라인 편집, 그레이딩, Fusion, Fairlight, 렌더 설정 등 고수준 도구를 호출하고, 일관된 결과 래퍼를 통해 안전하고 감사 가능한 자동화를 수행할 수 있습니다. 유료 Studio 에디션은 일반적인 외부 스크립팅 인터페이스를 통해 작동하며, 무료 에디션에 접근하기 위한 Lua 기반 브리지도 포함되어 있습니다. 선택 사항인 Node 기반 '고급' 서버는 Resolve를 실행하지 않고도 Resolve 프로젝트 파일을 편집할 수 있습니다. 이 패키지는 로컬 브라우저 제어 패널과 여러 IDE에 통합되어 있어, 온프레미스 AI 포스트 프로덕션 보조 도구를 위한 실용적인 기반을 제공합니다.
diffusionstudio/editor
JSX를 문서 소스로 사용하는 오픈소스 비디오 에디터로, AI 에이전트가 코드를 통해 비디오 편집, 모션 그래픽 생성, 미디어 분석을 수행할 수 있도록 전용 CLI를 제공합니다.
ATH-MaaS/Pixelle-Video
단일 주제로부터 스크립트, 비주얼, 나레이션을 생성하여 수동 편집 없이 완전한 영상을 제작하는 AI 기반 자동 숏폼 영상 엔진.
AIMixer/ComfyUI_MiniMaxH3_Director
ComfyUI용 플러그인으로, MiniMax H3를 위한 디렉터 콘솔을 제공하여 다중 세그먼트 비디오 계획, 동기화 오디오 생성, 긴 형식 AI 비디오를 위한 고급 정밀 조정 도구를 가능하게 합니다.
veedstudio/open-edit
코드 에이전트를 통해 자연어 명령으로 영상 편집, 자막 추가, 모션 그래픽 생성이 가능한 에이전트 기반 비디오 편집 파이프라인
fqscfqj/Y2A-Auto
Y2A‑Auto는 자체 호스팅형 Python/Flask 앱으로, YouTube 동영상을 다운로드하고 Whisper/Voxtral + OpenAI를 사용해 자막을 생성하거나 번역하며, 선택적으로 AI 기반 품질 검사 및 콘텐츠 모더레이션을 수행하고, 재인코딩(CPU 또는 GPU)한 후 AcFun, Bilibili 또는 양쪽에 업로드합니다. 웹 UI, YouTube 채널/키워드 모니터링, 알림 훅, CookieCloud 동기화, 보안 기능을 포함하며 Docker 또는 로컬에서 실행 가능합니다.
Junchao-cs/SolarWM
짧은 훈련 클립으로부터 장기 시간 범위의 카메라 제어 비디오 생성을 가능하게 하는, 대화형 비디오 세계 모델 구축을 위한 오픈소스 기반입니다.
OpenVDN/vdn-minimax-h3
VDN-Minimax-H3 (VDN-H3)는 MiniMax H3를 기반으로 구축된 하이브리드 어텐션 비디오 확산 모델입니다. 경량 선형 어텐션 브랜치와 LoRA 어댑터를 추가하여 768p 비디오를 실시간에 가깝게 생성할 수 있습니다 (예: 단일 B200 GPU에서 약 11초 만에 14초 클립 생성). 이 저장소는 전체 학습 스크립트(4단계 레시피)와 FP8 및 FlashAttention-4를 사용한 최적화된 추론 코드를 제공하며, 상세한 설정 지침과 성능 표를 포함하고 있습니다.
cosmo-wander-ai/cosmo-edge
CosmoEdge 1.1은 비디오 분석 및 비전-언어 모델을 위한 Apache-2.0 C++ 엣지 AI 엔진입니다. Sophon (BM1688/CV186X), Rockchip (RK3576/RV1126B) NPU에서 실행되며 Docker를 통해 x86/macOS를 지원하고, 브라우저 기반 파이프라인 빌더, REST/MQTT/WebSocket 통합, 상용 모델 보호를 위한 "Model Guard"를 제공합니다. 리포지토리에는 장치별 런타임 빌드를 위한 Docker 스크립트, 벤치마크 보고서 및 광범위한 문서가 포함되어 있습니다.
0xsline/OpenChatCut
전문적인 멀티트랙 타임라인과 대화형 에이전트를 결합한 오픈소스, 로컬 우선 AI 비디오 편집기. 편집 가능한 에이전트 기반 비디오 제작을 가능하게 합니다.
Anil-matcha/AI-Youtube-Shorts-Generator
AI‑YouTube‑Shorts‑Generator는 긴 YouTube 동영상(또는 로컬 파일)을 TikTok/Reels/YouTube Shorts용으로 최적화된 세로형 짧은 클립으로 자동 변환하는 오픈소스 Python 도구입니다. 동영상을 다운로드하고 Whisper로 음성 인식을 수행한 후, OpenAI, Gemini 또는 MuAPI의 모델을 사용해 '바이러스성'이 있을 만한 순간을 LLM 기반으로 평가합니다. 겹치는 후보를 중복 제거하고 각 하이라이트를 9:16(또는 원하는 비율)로 자동 자릅니다. 두 가지 모드 제공: 다운로드, 음성 인식, 평가, 자르기를 MuAPI에 위임하는 'API 모드'(설정 없음)와 `yt‑dlp`, `faster‑whisper`, OpenCV/ffmpeg, 외부 LLM을 로컬에서 실행하는 '로컬 모드'. CLI는 MP4 파일과 함께 각 클립의 점수, 핵심 문장, 이유를 반환하며, 상세한 JSON 파일도 출력 가능합니다. MIT 라이선스로, 크리에이터, 에이전시, 개발자가 자체 클리핑 SaaS를 구축하는 데 적합합니다.
Alisa0808/vox-director
스크립트부터 키프레임, 모션, 내레이션까지 모든 과정을 처리하여 Vox 스타일의 페이퍼 콜라주 설명 영상을 자동으로 제작하는 에이전트 스킬입니다.
gnipbao/story-to-handdrawn-video
20가지 내장 스타일을 갖춘 텍스트나 이미지를 세로형 손그림 애니메이션으로 변환하는 도구로, AI 에이전트의 기술을 통해 자동화 가능합니다.
gamedev-skills/awesome-gamedev-agent-skills
엔진별 코드 가이드, 전문 분야, 장르 및 워크플로우 템플릿을 포함한 73개의 AI 에이전트 '스킬' 라이브러리와, 게임 엔진을 자동 감지하고 필요한 부분만 로드하는 라우터를 제공하여 Claude, Cursor, Gemini-CLI 등 AI 에이전트가 필요에 따라 게임 코드를 생성할 수 있게 합니다.
Emily2040/seedance-2.0
AI 동영상 생성을 위한 에이전트 스킬로, 흐릿한 아이디어를 방향성 있는 프롬프트로 변환하고, 촬영 계획, 참조 연결, 클립 간 연속성을 관리합니다.
yizhi-chengzi/video-ai-talking
Alibaba Bailian VideoRetalk를 사용한 리프싱크, Bailian 또는 Volcengine의 TTS, 선택적 DeepSeek 스크립트 생성, FFmpeg를 통한 최종 렌더링을 활용해 침묵한 얼굴 카메라 영상을 완전한 대화 영상으로 변환하는 로컬 웹 앱입니다.
nkxx188/ComfyUI-MiniMaxH3-Easy
텍스트-비디오, 이미지-비디오, 참조 기반 비디오 생성을 통합 미디어 입력 시스템으로 단순화하는 MiniMax H3용 컴팩트한 ComfyUI 인터페이스입니다.
AlayaLab/Evoke
외부 세계 상태 은행을 사용하는 3단계 CFG 프리 월드 모델로, 비행 중 리프롬프팅과 카메라 제어를 가능하게 하여 무한하고 고품질의 동영상 생성을 실현합니다.
HKUDS/ViMax
ViMax는 텍스트 아이디어, 스크립트, 소설의 일부를 완전한 AI 생성 비디오로 변환하는 오픈소스 에이전트 기반 프레임워크입니다. 스크립트 작성, 스토리보드 작성, 캐릭터 일관성, 최종 렌더링을 설정 가능한 LLM, 이미지, 비디오 API로 처리합니다. 터미널 TUI 또는 브라우저 기반 웹 UI를 사용할 수 있으며, `uv sync`로 설치하고 `configs/agent.local.yaml`에 API 키를 설정한 후 `vimax tui` 또는 `npm run dev`로 UI를 실행합니다.
zhouxiaoka/autoclip
AI 기반 비디오 클리핑 도구로, YouTube와 Bilibili에서 자동으로 비디오를 다운로드하고, LLM을 통해 콘텐츠를 분석해 하이라이트를 추출하고, 짧은 형식의 컬렉션을 생성합니다.
ArcReel/ArcReel
구조화된 생성 파이프라인을 통해 스크립트와 소설을 일관된 단편 영상으로 변환하는 오픈소스이자 자체 호스팅 가능한 AI 영상 제작 워크벤치입니다.
xixihhhh/clipforge
ClipForge는 단일 제품 이미지(또는 짧은 텍스트 프롬프트)를 Douyin, Kuaishou, Xiaohongshu, TikTok 등에 게시 가능한 준비된 단편 영상으로 변환하는 오픈소스 AI 도구입니다. 스크립트 작성, 스토리보드 생성, 이미지-영상 합성, TTS, 자막, BGM, 최종 FFmpeg 스티칭을 자동화합니다. 공개 자산과 Edge TTS를 사용하는 완전 무료 경로와, 생성된 콘텐츠 초당 요금제의 유료 AI 생성 경로가 있습니다. 디렉터/초보자 모드, 촬영 간 일관성, 선택적 재생성, 391개 템플릿 라이브러리, 핫토픽 자동 생성, 배치 생산, 내장된 컴플라이언스(AIGC 라벨링, 광고법 금지어 스캔), CLI/MCP/에이전트 통합, AGPL-3.0 라이선스를 갖추고 있습니다. 전자상거래 판매자, 마케터, 크리에이터, 개발자가 빠르고 저비용의 제품 영상을 필요로 할 때 이상적입니다.
ChenShuo2004/cs-board
cs-board는 중국어 텍스트, 참조 오디오, 선택적 스타일/캐릭터 이미지를 입력하면 완전히 렌더링된 화이트보드 스타일의 MP4로 변환하는 로컬에서 실행되는 AI 영상 제작 워크스테이션입니다. IndexTTS를 통한 음성 클론, 스크립트 분할, AI 생성 일러스트, 손그림 애니메이션, 자막, 음성-영상 동기화를 처리하며, 12가지 시각 템플릿, 사용자 정의 캐릭터/스타일 지원, 동적 인포그래픽, LAN 기반 협업 큐를 제공합니다.
NikoDemon80/ComfyUI-H3-Motion-Context
MiniMax H3용 ComfyUI 확장으로, 잠재 기반 연속성을 사용하여 품질 손실과 움직임 및 소리의 점프를 방지하고 비디오 및 오디오 클립을 원활하게 연결할 수 있도록 합니다.
LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler
Minimax H3용 사용자 정의 ComfyUI 노드 세트로, 신경망 기반 레이턴트 확대와 타일 기반 재샘플링을 제공하여 VAE 디코딩-인코딩 사이클의 부담을 피하면서 고해상도 비디오 생성 속도를 가속화합니다.
cartesiancs/cartcut
모션 그래픽스와 레이어 기반 편집에 특화된 AI 기반 동영상 편집기. 자동 자막 기능과 고해상도 렌더링을 제공합니다.
GVCLab/PersonaLive
단일 참조 이미지와 드라이빙 비디오에서 무한 길이의 표현력 있는 포트레이트 애니메이션을 실시간으로 스트리밍 가능한 확산 프레임워크.
Carasibana/ComfyUI-H3-FaceRefine
ComfyUI 커스텀 노드 세트로, MiniMax H3 동영상에서 작은 얼굴의 품질을 얼굴 감지, 자르기, 재생성, 원본 클립에 재합성하여 향상시킵니다
xhongc/ai_story
AI Story는 여러 AI 모델을 사용하여 스토리 프롬프트에서 시작해 스크립트 작성, 스토리보드 생성, 이미지 생성, 카메라 움직임 계획, 영상 렌더링까지 전 과정을 자동화하는 Docker 기반 웹 애플리케이션입니다.
palmier-io/palmier-pro
AI 에이전트가 타임라인에서 직접 콘텐츠 생성 및 편집이 가능한, 내장형 생성형 AI와 MCP 지원을 갖춘 macOS 비디오 에디터입니다.
nexu-io/html-video
로컬 코딩 에이전트와 플러그형 HTML 기반 렌더링 엔진을 사용하여 텍스트, 기사 또는 GitHub 리포지토리를 애니메이션 MP4 비디오로 변환하는 메타 레이어.
huangserva/ComfyUI_MiniMaxH3_Director
MiniMax H3 Director를 위한 ComfyUI 워크플로우 모음으로, 텍스트-to-비디오, 이미지-to-비디오 및 참조 자료를 활용한 고급 비디오-to-비디오 편집을 지원합니다.
YILS-LIN/short-video-factory
텍스트 프롬프트와 영상 클립에서 AI 기반 데스크톱 도구를 사용해 제품 마케팅 및 일반 콘텐츠용 짧은 영상 자동 생성
Huanshere/VideoLingo
AI를 활용해 전문적인 단일 줄 자막과 고품질 음성 오버레이를 생성하는 종합적인 동영상 번역 및 더빙 도구입니다.
hao-ai-lab/FastVideo
희소 증류 및 어텐션 최적화를 통해 비디오 생성을 가속화하도록 설계된 통합 사후 학습 및 실시간 추론 프레임워크입니다.
liangdabiao/Seedance2-Storyboard-Generator
Claude Code와 Seedance 2.0을 활용해 이야기를 일관성 있는 다중 에피소드 영상 시리즈로 변환하는 AI 영상 제작 워크플로우입니다.
lcy362/agnes-video-generator
고성능 GPU가 필요 없으며, 클라우드 API를 사용해 텍스트나 이미지에서 나레이션과 자동 자막이 포함된 다중 장면 영상을 생성하는 무료 오픈소스 AI 영상 생성기입니다.
jd-opensource/JoyAI-Video-Edit
프레임이 도착하는 즉시 자기회귀 확산을 사용하여 라이브 동영상 스트림 또는 업로드된 동영상을 실시간으로 편집하는 시스템입니다.
Stonewuu/ai-fusion-video
스크립트 작성, 스토리보드 작성, AI 이미지/동영상 생성을 통합한 에이전트 기반 동영상 제작 플랫폼입니다.
Lightricks/LTX-2
LTX-2는 텍스트 또는 이미지 프롬프트로부터 고충실도, 동기화된 오디오와 비디오를 생성하는 DiT 기반 오디오-비디오 파운데이션 모델입니다.