hypit-ai/hypit
Hypit은 LLM 에이전트가 참조 동영상(또는 설명)을 기반으로 선언적 SVML 워크플로우를 통해 동영상을 클로닝하거나 생성할 수 있는 오픈소스 프레임워크입니다. 참조 동영상(또는 설명)을 드롭하면 AI가 완전한 프로덕션 파이프라인(영상, 자막, B-롤, 효과)을 구축하고 헤드리스 Chromium으로 렌더링합니다. 이 시스템은 저비용 대량 변형 생성, 플러그인 가능한 구성 요소, 그리고 선택적 제로비용 렌더링(외부 AI 호출 없음)을 지원합니다. `npx skills add hypit-ai/hypit -g`로 설치 후, 어떤 코딩 에이전트 세션에서든 `/hypit` 스킬을 사용해 동영상을 생성하거나 리믹스할 수 있습니다. 허용성 있는 Apache-2.0 기반 라이선스로 제공됩니다.
mcncarl/jianying-headless
macOS용 Jianying Pro의 로컬 자동화 도구로, 프로그래밍 방식으로 편집 가능한 비디오 초안을 생성하고 AI 비디오 워크플로우를 위한 네이티브 MP4 내보내기를 지원합니다.
calesthio/OpenMontage
일반 텍스트 프롬프트에서 프로페셔널한 영상을 생성하기 위한 오픈소스, 에이전트형 영상 제작 시스템. 연구, 스크립트 작성, 자산 생성, 편집을 자동화합니다.
heygen-com/hyperframes
HyperFrames는 일반적인 HTML + CSS(특수한 `data-*` 타이밍 속성 포함)로 동영상을 설명하고 결정론적인 MP4로 렌더링할 수 있는 오픈소스 Node.js 프레임워크입니다. AI 코딩 에이전트(Claude, Gemini, Cursor 등)가 로드할 수 있는 '스킬' 세트를 제공하여, LLM에 '10초짜리 제품 소개를 만들어줘'라고 지시하면 자동으로 HTML을 생성하고, 자산을 가져오며, Lint를 실행하고, 미리보기를 수행한 후 CLI(`hyperframes render`)로 렌더링합니다. GSAP, Lottie, Three.js, CSS 등 다양한 애니메이션 런타임을 지원하고, 통합 미디어 매니저, 클라우드/Lambda 렌더링, 재사용 가능한 디자인 블록 카탈로그를 갖추고 있습니다. AI 기반 영상 생성 파이프라인과 웹 중심, 코드 중심의 영상 제작 워크플로우를 원하는 디자이너에게 이상적입니다.
harry0703/MoneyPrinterTurbo
주제나 키워드를 입력하면 스크립트, 보이스오버, 자막, 매칭된 영상까지 포함한 완전한 영상을 자동으로 생성하는 AI 단편 영상 생성 도구.
jub0t/Concat
AI 기능을 로컬에서 실행하는 프라이버시 중심의 오픈소스 크로스플랫폼 동영상 편집기. CapCut의 대안으로 오프라인 AI 자막, 음성, 컷아웃 기능을 제공.
ArcReel/ArcReel
소설, 스크립트, 제품 자료 등을 일관되고 제어 가능한 짧은 동영상으로 변환하는 오픈소스이며 자체 호스팅 가능한 AI 동영상 제작 워크벤치입니다.
Vincentwei1021/video-shotcraft
AI 에이전트 스킬로 Remotion을 사용해 제품 스크린샷과 텍스트를 기반으로 영화적 프로모션 영상을 생성하며, 157개의 샷 레시피 카드 라이브러리를 활용합니다.
Vincentwei1021/anything2explainer
AI 에이전트가 Remotion 코드를 작성하여 주제나 문서를 나레이션 있는 모션 그래픽 해설 영상으로 변환하는 AI 기반 파이프라인
dramaclaw/dramaclaw
DramaClaw는 스크립트를 AI 생성 단편 영화로 변환하는 Docker 기반의 셀프 호스팅 플랫폼입니다. 이미지, 비디오, 오디오 및 3D 세트 제작을 위한 노드 기반 무한 캔버스(XiaHua)와 수집, 에피소드 계획, 스토리보드 생성, 더빙, 비디오 합성 및 내보내기를 처리하는 구조화된 파이프라인(Series)을 제공합니다. 통합된 AI 어시스턴트(Xia Director)가 작업을 실행하고 다음 단계를 제안합니다. 모든 무거운 모델 추론은 OpenAI 호환 게이트웨이를 통해 라우팅되므로 원하는 공급자를 사용할 수 있습니다. Elastic 2.0 라이선스로 출시되었으며, "Powered by DramaClaw"라고 명시하면 상업적으로 이용할 수 있습니다.
zhouxiaoka/autoclip
AI 기반 비디오 클리핑 도구로, YouTube와 Bilibili에서 자동으로 비디오를 다운로드하고, LLM을 통해 콘텐츠를 분석해 하이라이트를 추출하고, 짧은 형식의 컬렉션을 생성합니다.
eternityspring/reelbench-skills
Claude Code와 Codex를 위한 스킬 모음으로, 동영상 쇼트 분석을 자동화하고 동기화된 동영상 정보 오버레이를 생성합니다.
browser-use/video-use
사용자가 채팅을 통해 원본 영상을 편집할 수 있는 오픈소스 AI 동영상 편집 도구. 동영상을 구조화된 텍스트와 필요 시 시각 정보로 변환하여 LLM이 처리할 수 있도록 합니다.
cosmo-wander-ai/cosmo-edge
CosmoEdge 1.1은 비디오 분석 및 비전-언어 모델을 위한 Apache-2.0 C++ 엣지 AI 엔진입니다. Sophon (BM1688/CV186X), Rockchip (RK3576/RV1126B) NPU에서 실행되며 Docker를 통해 x86/macOS를 지원하고, 브라우저 기반 파이프라인 빌더, REST/MQTT/WebSocket 통합, 상용 모델 보호를 위한 "Model Guard"를 제공합니다. 리포지토리에는 장치별 런타임 빌드를 위한 Docker 스크립트, 벤치마크 보고서 및 광범위한 문서가 포함되어 있습니다.
diffusionstudio/editor
AI 에이전트를 위한 전문적인 비디오 에디터로, 비디오 컴포지션을 코드로 취급하여 에이전트와 인간이 이중 방향적인 JSX 기반 워크플로우로 공동으로 비디오 편집할 수 있도록 합니다.
AIMixer/ComfyUI_MiniMaxH3_Director
MiniMax‑H3 모델을 사용한 다중 세그먼트 동영상 생성을 위한 UI 기반 '디렉터' 노드를 제공하는 ComfyUI 플러그인. 텍스트, 이미지, 참조, 동영상→동영상 작업, 음성 생성, 움직임 연속성, 2단계 정제, 프로젝트 팩 수입/수출을 지원.
luoluoluo22/jianying-editor-skill
자연어를 사용하여 스크립트, 음성, 효과를 포함한 완전한 동영상 드래프트를 생성할 수 있는 제이잉(캡컷 중국판)용 AI 기반 자동화 기술입니다.
samuelgursky/davinci-resolve-mcp
DaVinci Resolve MCP는 완전한 DaVinci Resolve Studio 스크립팅 API를 JSON-Over-HTTP 서비스로 노출하는 오픈소스 서버입니다. AI 에이전트는 프로젝트 생성, 미디어 가져오기, 타임라인 편집, 그레이딩, Fusion, Fairlight, 렌더 설정 등 고수준 도구를 호출하고, 일관된 결과 래퍼를 통해 안전하고 감사 가능한 자동화를 수행할 수 있습니다. 유료 Studio 에디션은 일반적인 외부 스크립팅 인터페이스를 통해 작동하며, 무료 에디션에 접근하기 위한 Lua 기반 브리지도 포함되어 있습니다. 선택 사항인 Node 기반 '고급' 서버는 Resolve를 실행하지 않고도 Resolve 프로젝트 파일을 편집할 수 있습니다. 이 패키지는 로컬 브라우저 제어 패널과 여러 IDE에 통합되어 있어, 온프레미스 AI 포스트 프로덕션 보조 도구를 위한 실용적인 기반을 제공합니다.
ATH-MaaS/Pixelle-Video
단일 주제로부터 스크립트, 비주얼, 나레이션을 생성하여 수동 편집 없이 완전한 영상을 제작하는 AI 기반 자동 숏폼 영상 엔진.
Vincentwei1021/video-talkcraft
스크립트와 음성 해설을 캐릭터 수준 자동 오디오 동기화와 108개의 모션 그래픽 템플릿 라이브러리를 갖춘 전문적인 설명 동영상으로 변환하는 AI 에이전트 스킬.
kaomei/stickman-video-director
Gemini Omni Flash를 사용하여 일관된 1분짜리 졸라맨 애니메이션을 만들기 위한, 텍스트를 구조화된 감독 제안서와 최적화된 프롬프트로 변환하는 Codex Skill입니다.
SkyNotSilent/awesome-MiniMax-H3-cases
MiniMax H3 생성 동영상의 실제 사례, 완전한 프롬프트, 하드웨어별 튜토리얼을 포함한 커뮤니티 운영 카탈로그. 검색 가능한 웹 UI, JSON 데이터, AI 에이전트 스킬 제공. MIT 라이선스, 출처 명시 콘텐츠.
AlayaLab/Evoke
외부 월드 스테이트 뱅크를 사용하여 일관성 있는 무한 비디오 롤아웃을 생성하고, 비행 중 재프롬프팅 기능을 갖춘 고속 3단계 월드 모델입니다.
shengshu-ai/Vidu-S
고해상도 디지털 아바타, 라이브 비디오 편집, 몰입형 공간 비디오를 위한 실시간 대화형 비디오 생성 모음입니다.
thu-ml/TurboDiffusion
TurboDiffusion은 어텐션 가속 및 타임스텝 증류를 사용하여 엔드투엔드 확산 생성을 100~200배 가속화하는 비디오 생성 가속 프레임워크입니다.
cartesiancs/cartcut
무거운 소프트웨어 없이도 전문적인 효과를 생성할 수 있는, 레이어 기반 편집과 모션 그래픽 도구를 갖춘 AI 기반 비디오 에디터입니다.
0xsline/OpenChatCut
전문적인 멀티트랙 타임라인과 대화형 에이전트를 결합한 오픈소스, 로컬 우선 AI 비디오 편집기. 편집 가능한 에이전트 기반 비디오 제작을 가능하게 합니다.
letorig/video-generator-client
Seedance, Kling, MiniMax, Wan을 포함한 여러 제공자 간에 동영상을 생성하기 위한 통합 인터페이스를 제공하는 비동기 Python 클라이언트와 웹 UI입니다.
shuyu-labs/BigBanana-AI-Director
BigBanana AI Director는 Docker로 배포 가능한 웹 플랫폼으로, 스크립트(또는 단일 문장)를 단편 영화/모션 만화로 변환합니다. AntSK의 텍스트, 이미지, 비디오 모델을 사용해 각 장면을 시작 및 종료 키프레임으로 제어하고, Veo 모델로 움직임을 보간하며, 프로젝트 전체 자산 라이브러리, 샷 그리드 UI, 간단한 타임라인 에디터를 제공해 최종 내보내기를 지원합니다.
hao-ai-lab/FastVideo
희소 증류 및 어텐션 최적화를 통해 비디오 생성을 가속화하도록 설계된 통합 사후 학습 및 실시간 추론 프레임워크입니다.
Colafornia/short-video-generator-AI
YouTube 또는 로컬 동영상에서 세로형 숏 클립을 자동 생성하는 오픈소스 Python 도구입니다. 로컬 Whisper로 전사하고, LLM(OpenAI, Gemini 또는 MuAPI)으로 바이럴 순간을 순위화하며, 선택적으로 AI 생성 훅을 추가하고, 간단한 CLI 또는 로컬 웹 UI를 통해 클립을 렌더링합니다.
Junchao-cs/SolarWM
SolarWM은 대량의 카메라 주석 비디오 데이터셋, 3단계 학습 레시피, 그리고 즉시 사용 가능한 5 B–33 B 비디오 월드 모델 체크포인트(Wan2.2, LTX-2.5, MiniMax-H3)를 제공하는 오픈소스 프레임워크입니다. 통합 CLI와 완전히 문서화된 파이프라인을 통해 장기 지평선 인터랙티브 비디오 모델을 학습하고 실행할 수 있습니다.
YILS-LIN/short-video-factory
텍스트 프롬프트와 영상 클립에서 AI 기반 데스크톱 도구를 사용해 제품 마케팅 및 일반 콘텐츠용 짧은 영상 자동 생성
Alisa0808/vox-director
스크립트부터 키프레임, 모션, 내레이션까지 모든 과정을 처리하여 Vox 스타일의 페이퍼 콜라주 설명 영상을 자동으로 제작하는 에이전트 스킬입니다.
gamedev-skills/awesome-gamedev-agent-skills
엔진별 코드 가이드, 전문 분야, 장르 및 워크플로우 템플릿을 포함한 73개의 AI 에이전트 '스킬' 라이브러리와, 게임 엔진을 자동 감지하고 필요한 부분만 로드하는 라우터를 제공하여 Claude, Cursor, Gemini-CLI 등 AI 에이전트가 필요에 따라 게임 코드를 생성할 수 있게 합니다.
liangdabiao/Seedance2-Storyboard-Generator
Claude Code와 Seedance 2.0을 활용해 이야기를 일관성 있는 다중 에피소드 영상 시리즈로 변환하는 AI 영상 제작 워크플로우입니다.
nateherkai/hyperframes-student-kit
Codex 또는 Claude Code에 자연어 프롬프트로 영상 편집을 지시할 수 있는 오픈소스 AI 지원 동영상 편집 키트입니다. 14개의 에이전트 기반 "스킬", 400개 이상의 모션 그래픽 카드, 장면 템플릿, 트랜스크립션 도우미(11Labs, Whisper), 그리고 데모 프로젝트를 포함합니다. Node 22+, Git, FFmpeg를 설치한 후 `npm run demo`를 실행하고 `$edit-video` 또는 `/short-form-edit`와 같은 명령어로 무음 제거, 오류 수정, 리얼 또는 숏 생성이 가능합니다. 선택적 API 키로 클라우드 트랜스크립션 및 자산 생성을 활성화할 수 있으며, 그렇지 않으면 합성 데이터로 로컬에서 작동합니다.
fqscfqj/Y2A-Auto
Y2A‑Auto는 YouTube 동영상을 다운로드하고, 선택적으로 Whisper/Voxtral ASR를 실행하며, 자막을 번역하고 품질을 검사하고, OpenAI를 통해 제목/태그를 생성하고, CPU 또는 GPU로 인코딩한 후 AcFun 및/또는 bilibili에 업로드하는 오픈소스이며 Docker 대응 가능한 파이프라인입니다. Flask 기반 웹 UI, YouTube 모니터링, CookieCloud 동기화, 콘텐츠 모니터링, 다중 채널 알림 지원 기능을 포함하며, JSON 파일로 구성 가능하고 비밀번호/잠금 기능으로 보호됩니다.
Lightricks/LTX-2
LTX-2는 텍스트 또는 이미지 프롬프트로부터 고충실도, 동기화된 오디오와 비디오를 생성하는 DiT 기반 오디오-비디오 파운데이션 모델입니다.
Emily2040/seedance-2.0
AI 동영상 생성을 위한 에이전트 스킬로, 흐릿한 아이디어를 방향성 있는 프롬프트로 변환하고, 촬영 계획, 참조 연결, 클립 간 연속성을 관리합니다.
Anil-matcha/AI-Youtube-Shorts-Generator
LLM을 이용한 하이라이트 감지와 Whisper를 이용한 자막 생성을 통해 긴 YouTube 영상을 바이럴한 세로형 숏폼 영상으로 변환하는 오픈소스 AI 도구입니다.
Robbyant/lingbot-world-v2
LingBot‑World‑V2는 텍스트 프롬프트에서 무한하고 상호작용 가능한 세계를 생성하는 연구용 비디오 생성 모델입니다. 빠른(실시간) 및 고품질 버전(14 B 및 1.3 B)을 제공하며, 다양한 행동을 지원하고, 파ilot-디렉터 에이전트 아키텍처를 사용합니다. 리포지토리는 추론 코드, 모델 다운로드 링크, 빠른 시작 가이드를 제공하지만, 배포 코드는 공개되지 않았습니다.
palmier-io/palmier-pro
AI 에이전트가 타임라인에서 직접 콘텐츠 생성 및 편집이 가능한, 내장형 생성형 AI와 MCP 지원을 갖춘 macOS 비디오 에디터입니다.
gnipbao/story-to-handdrawn-video
20가지 내장 스타일을 갖춘 텍스트나 이미지를 세로형 손그림 애니메이션으로 변환하는 도구로, AI 에이전트의 기술을 통해 자동화 가능합니다.
OpenVDN/vdn-minimax-h3
VDN-Minimax-H3 (VDN-H3)는 MiniMax H3를 기반으로 구축된 하이브리드 어텐션 비디오 확산 모델입니다. 경량 선형 어텐션 브랜치와 LoRA 어댑터를 추가하여 768p 비디오를 실시간에 가깝게 생성할 수 있습니다 (예: 단일 B200 GPU에서 약 11초 만에 14초 클립 생성). 이 저장소는 전체 학습 스크립트(4단계 레시피)와 FP8 및 FlashAttention-4를 사용한 최적화된 추론 코드를 제공하며, 상세한 설정 지침과 성능 표를 포함하고 있습니다.
MemeCalculate/moyin-creator
스크립트 파싱, 캐릭터 일관성, 배치 영상 생성에 이르기까지 전체 파이프라인을 자동화하는 프로덕션 수준의 AI 영화 제작 도구
xixihhhh/clipforge
ClipForge는 단일 제품 이미지(또는 짧은 텍스트 프롬프트)를 Douyin, Kuaishou, Xiaohongshu, TikTok 등에 게시 가능한 준비된 단편 영상으로 변환하는 오픈소스 AI 도구입니다. 스크립트 작성, 스토리보드 생성, 이미지-영상 합성, TTS, 자막, BGM, 최종 FFmpeg 스티칭을 자동화합니다. 공개 자산과 Edge TTS를 사용하는 완전 무료 경로와, 생성된 콘텐츠 초당 요금제의 유료 AI 생성 경로가 있습니다. 디렉터/초보자 모드, 촬영 간 일관성, 선택적 재생성, 391개 템플릿 라이브러리, 핫토픽 자동 생성, 배치 생산, 내장된 컴플라이언스(AIGC 라벨링, 광고법 금지어 스캔), CLI/MCP/에이전트 통합, AGPL-3.0 라이선스를 갖추고 있습니다. 전자상거래 판매자, 마케터, 크리에이터, 개발자가 빠르고 저비용의 제품 영상을 필요로 할 때 이상적입니다.
HKUDS/ViMax
ViMax는 서사 기획과 스크립트 작성에서 일관된 다중 장면 동영상 생성에 이르기까지 전체 프로세스를 자동화하는 에이전트형 동영상 생성 프레임워크입니다.