xixihhhh/clipforge

ClipForge는 단일 제품 이미지(또는 짧은 텍스트 프롬프트)를 Douyin, Kuaishou, Xiaohongshu, TikTok 등에 게시 가능한 준비된 단편 영상으로 변환하는 오픈소스 AI 도구입니다. 스크립트 작성, 스토리보드 생성, 이미지-영상 합성, TTS, 자막, BGM, 최종 FFmpeg 스티칭을 자동화합니다. 공개 자산과 Edge TTS를 사용하는 완전 무료 경로와, 생성된 콘텐츠 초당 요금제의 유료 AI 생성 경로가 있습니다. 디렉터/초보자 모드, 촬영 간 일관성, 선택적 재생성, 391개 템플릿 라이브러리, 핫토픽 자동 생성, 배치 생산, 내장된 컴플라이언스(AIGC 라벨링, 광고법 금지어 스캔), CLI/MCP/에이전트 통합, AGPL-3.0 라이선스를 갖추고 있습니다. 전자상거래 판매자, 마케터, 크리에이터, 개발자가 빠르고 저비용의 제품 영상을 필요로 할 때 이상적입니다.

xhongc/ai_story

AI Story는 여러 AI 모델을 사용하여 스토리 프롬프트에서 시작해 스크립트 작성, 스토리보드 생성, 이미지 생성, 카메라 움직임 계획, 영상 렌더링까지 전 과정을 자동화하는 Docker 기반 웹 애플리케이션입니다.

nkxx188/ComfyUI-MiniMaxH3-Easy

MiniMax H3 동영상 생성을 위한 실용적인 ComfyUI 노드 세트로, 통합 미디어 관리와 컨텍스트 세그먼트를 통한 긴 일관성 있는 동영상 생성을 제공합니다.

taco-group/SparkVSR

SparkVSR는 사용자가 희소한 고품질 키프레임을 사용하여 복원 프로세스를 안내할 수 있는 인터랙티브 동영상 슈퍼레졸루션 프레임워크로, 더 나은 시간적 일관성과 제어 가능한 결과를 보장합니다.

video-production-buddy/video-production-buddy

1회 프롬프트 대신 계획, 승인 게이트, 검증된 렌더링을 포함한 통제 가능한 워크플로우로 구성된 에이전트 중심 AI 영상 제작 파이프라인

yizhi-chengzi/video-ai-talking

Alibaba Bailian VideoRetalk를 사용한 리프싱크, Bailian 또는 Volcengine의 TTS, 선택적 DeepSeek 스크립트 생성, FFmpeg를 통한 최종 렌더링을 활용해 침묵한 얼굴 카메라 영상을 완전한 대화 영상으로 변환하는 로컬 웹 앱입니다.

LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler

Minimax H3용 사용자 정의 ComfyUI 노드 세트로, 신경망 기반 레이턴트 확대와 타일 기반 재샘플링을 제공하여 VAE 디코딩-인코딩 사이클의 부담을 피하면서 고해상도 비디오 생성 속도를 가속화합니다.

Carasibana/ComfyUI-H3-FaceRefine

ComfyUI‑H3‑FaceRefine는 ComfyUI용 커스텀 노드 팩으로, MiniMax H3의 동영상 생성 시 작은 얼굴의 렌더링을 개선합니다. 얼굴을 감지하고 더 큰 캔버스로 자르며, H3 모델로 재처리한 후 원본 동영상에 다시 붙입니다. 자동 및 수동 얼굴 선택 모드, 하드 컷 감지, 프레임별 노이즈 제거, 즉시 사용 가능한 예시 워크플로우를 포함합니다.

pireel/pireel

Pireel Studio는 수동 타임라인 편집, 채팅 기반 설명, AI 에이전트를 결합하여 비디오를 만들 수 있는 오픈소스 AI 비디오 편집기입니다.

NikoDemon80/ComfyUI-H3-Motion-Context

MiniMax H3용 ComfyUI 확장으로, 잠재 기반 연속성을 사용하여 품질 손실과 움직임 및 소리의 점프를 방지하고 비디오 및 오디오 클립을 원활하게 연결할 수 있도록 합니다.

veedstudio/open-edit

자연어 설명을 기반으로 코드 에이전트가 오디오 인식, 디자인, MP4 렌더링을 수행하는 에이전트 기반 동영상 편집 파이프라인.

KlingAIResearch/LivePortrait

드라이빙 비디오 또는 이미지를 사용하여 인간과 동물의 정지 영상을 정밀한 스티칭 및 리타겟팅 제어와 함께 애니메이션화하는 효율적인 초상화 애니메이션 도구입니다.

Stonewuu/ai-fusion-video

스크립트 작성, 스토리보드 작성, AI 이미지/동영상 생성을 통합한 에이전트 기반 동영상 제작 플랫폼입니다.

MartinDelophy/ai-video-editor

Timeline Studio는 WebGPU/ONNX에서 실행되는 브라우저 전용 로컬 우선 AI 비디오 편집기로, 미디어를 업로드하지 않고 다국어 TTS, AI 생성 음악, 자동 자막, 스마트 프레임, 워터마크 제거, 보컬 분리, 디지털 인간 아바타를 제공합니다. 프로젝트는 포터블 `.timeline` 파일로 저장되며, 풍부한 UI 또는 LLM 에이전트가 검사, 계획, 프로그래밍적으로 편집할 수 있는 헤드리스 CLI 스킬로 편집 가능합니다. 코드는 MIT 라이선스이며, 모델 가중치는 Hugging Face와 ModelScope에 미러링되어 원래 라이선스에 따라 사용됩니다.

lcy362/agnes-video-generator

클라우드 API를 사용하여 나레이션과 자막이 포함된 다중 장면 비디오를 생성하는 무료 오픈소스 AI 비디오 생성기. 고가의 GPU나 구독 서비스가 필요하지 않습니다.

Lightricks/LTX-Desktop

LTX Desktop는 LTX 확산 모델을 사용하여 동영상(및 이미지)을 생성하고 편집할 수 있는 오픈소스 Electron 앱입니다. NVIDIA GPU(≥16GB VRAM) 또는 Apple Silicon 맥(≥15GB 사용 가능 RAM)에서 로컬로 실행되며, 지원되지 않는 하드웨어에서는 유료 클라우드 API(LTX 2.5/2.3 Pro)로 자동 전환됩니다. 텍스트/이미지/오디오에서 동영상, 동영상 리테이크/연장, LoRA 스타일 어댑터, Gemini를 통한 프롬프트 강화, 타임라인 기반 동영상 편집기 등의 기능을 제공합니다. GitHub 릴리스 설치 프로그램을 통해 설치하며, 앱은 OS별 표준 폴더에 데이터를 저장하고 클라우드 텍스트 인코딩을 위해 무료 LTX API 키가 필요합니다. 코드베이스(Apache-2.0)는 React UI, Electron 쉘, Python FastAPI 백엔드로 분리되어 있으며, 로컬 빌드를 위한 완전한 개발 스크립트가 제공됩니다. 선택적 익명 테레메트리는 비활성화 가능합니다.

zai-org/SCAIL-2

SCAIL-2는 복잡한 움직임과 다양한 정체성을 지원하기 위해 중간 포즈 표현이 필요 없는 엔드투엔드 캐릭터 애니메이션 및 교체용 오픈소스 모델입니다.

FireRedTeam/FireRed-OpenStoryline

자연어 프롬프트를 통해 스크립트 작성, 미디어 조달, 편집을 자동화하는 대화형 AI 동영상 제작 도구.

crisng95/flowkit

Flow Kit는 Python‑FastAPI + Chrome 확장 프로그램 시스템으로, Google Flow를 통해 참조 이미지로 시각적 일관성을 유지하고, 장면 생성, TTS, 업스케일링, 썸네일 생성 및 YouTube 업로드를 포함한 엔드투엔드 AI 동영상 생성을 자동화합니다.

MeiGen-AI/OPSD-V

긴 동영상에서 오차 누적을 줄이고 운동 역학을 개선하기 위한, 후처리용 온폴리시 자기증류 프레임워크

Robbyant/lingbot-world

실시간 상호작용성과 장기적인 시간적 일관성을 갖춘 고충실도 인터랙티브 비디오 환경을 생성하는 오픈 소스 월드 시뮬레이터.

liyue-aigc/seedance-2-5-video-director

Dreamina/Jimeng Seedance 2.5용 비디오 연출 스킬로, 창의적인 아이디어와 참조 이미지를 구조화된 비디오 스크립트와 최적화된 프롬프트로 변환합니다.

nexu-io/html-video

로컬 코딩 에이전트와 플러그형 HTML 기반 렌더링 엔진을 사용하여 텍스트, 기사 또는 GitHub 리포지토리를 애니메이션 MP4 비디오로 변환하는 메타 레이어.

Tencent-Hunyuan/HunyuanVideo

HunyuanVideo는 130억 개가 넘는 파라미터를 가진 대규모 오픈소스 비디오 기반 모델로, 뛰어난 모션과 텍스트 정렬을 갖춘 고품질 비디오를 생성합니다.

jnMetaCode/ai-shortfilm-prompts

2026년 텍스트-동영상 모델용으로 최적화된 AI 동영상 프롬프트 라이브러리와 Claude Code 스킬. 어떤 아이디어도 즉시 실행 가능한 다중 씬 프롬프트로 변환. 장르 템플릿, 카메라 이동 라이브러리, 부정적 프롬프트 프리팹, 설치 없이 사용 가능한 웹 기반 빌더, 5단계 프롬프트 구조에 대한 상세 문서 포함.

myccarl/ai-shortVideo-pipeline

myAiVideos는 Docker Compose 기반의 오픈소스 시스템으로, 중국어 콘텐츠를 위한 단편 영상 제작 워크플로우(주제 → 스크립트 → 비주얼 → 오디오 → 편집 → 배포)를 완전 자동화합니다. FastAPI 오케스트레이터와 Java Spring-Boot 게이트웨이(인증, 라우팅, 회로 차단, 메터링)를 사용하며, DeepSeek, GLM, Kling, TTS 서비스 등 다양한 LLM 및 멀티모달 모델과 통합됩니다. 파이프라인은 계층적이고 장애 대체 가능하며, Langfuse와 Prometheus를 통해 완전한 관측성이 보장됩니다.

ModelTC/LightX2V

LightX2V는 빠른 이미지 및 동영상 생성(T2V, I2V, T2I, I2I, T2AV 등)을 위한 오픈소스 추론 프레임워크입니다. MiniMax-H3, Wan, HunyuanVideo, Qwen-Image 등 많은 최신 모델을 지원하며, 4단계 증류된 LoRA, FP8/NVFP4 양자화, 텐서/시퀀스 병렬 처리, 다양한 하드웨어에서의 분산 배포와 같은 성능 향상 기술을 제공합니다. H100 GPU에서 경쟁 프레임워크 대비 최대 3.9배 빠른 추론을 달성합니다. Docker 이미지, pip 설치, Gradio/ComfyUI 프론트엔드, 풍부한 문서, 온라인 데모를 제공합니다.

ChatCut-Inc/agent-plugin

AI 코딩 어시스턴트(Codex, Claude Code, Grok Bot, Cursor)가 자연어 프롬프트를 통해 ChatCut 비디오 프로젝트를 편집할 수 있도록 하는 플러그인 컬렉션입니다. 미디어 가져오기, 그래픽 추가, 오디오 생성, 전사, 내보내기 등을 지원합니다. ChatCut 계정 및 지원 대상 호스트 중 하나가 필요합니다. 인증은 ChatCut의 MCP 엔드포인트를 통해 처리됩니다.

LingGuoAI/LingGuo-Drama

스크립트 작성 및 자산 생성에서 최종 비디오 합성에 이르기까지 AI 쇼트 드라마 및 비디오 제작의 파이프라인을 관리하는 오픈소스 워크벤치입니다.

Rimagination/h3lite

MiniMax H3용 로컬 배포 기술로, Windows에서 저VRAM NVIDIA GPU를 사용해 AI 에이전트를 통해 네이티브 오디오가 포함된 동영상을 생성할 수 있습니다.

jianjieyiban/JJYB_AI_VideoAutoCut

소재 분석부터 대본 작성, 음성 생성 및 오디오-비주얼 동기화까지 워크플로우를 자동화하는 로컬 퍼스트 AI 비디오 제작 워크스테이션입니다.

ChenShuo2004/cs-board

cs-board는 중국어 텍스트, 참조 오디오, 선택적 스타일/캐릭터 이미지를 입력하면 완전히 렌더링된 화이트보드 스타일의 MP4로 변환하는 로컬에서 실행되는 AI 영상 제작 워크스테이션입니다. IndexTTS를 통한 음성 클론, 스크립트 분할, AI 생성 일러스트, 손그림 애니메이션, 자막, 음성-영상 동기화를 처리하며, 12가지 시각 템플릿, 사용자 정의 캐릭터/스타일 지원, 동적 인포그래픽, LAN 기반 협업 큐를 제공합니다.

zenstory-ai/video-recap-skills

AI 기반 동영상 리캡 시스템으로, 원시 영상에서 자동으로 동영상 이해, 대본 작성, 음성 합성, 편집까지 수행하여 나레이션 포함 요약으로 변환합니다.

FujiwaraChoki/supoclip

장편 동영상을 바이럴 가능한 세로 클립으로 자동 변환하는 오픈소스 AI 기반 동영상 클리핑 도구. 자동 얼굴 크롭, 자막, 바이럴성 점수 기능 제공.

HITsz-TMG/VideoClaw

스크립트 작성, 캐릭터 디자인, 스토리보드 작성, 최종 편집에 이르기까지 창의적인 동영상 제작 프로세스 전체를 자동화하는 AI 디렉터 시스템.

SandAI-org/MAGI-2-preview

텍스트 또는 이미지 프롬프트로부터 동기화된 사운드가 포함된 1080p 비디오 클립을 생성하는 114B 파라미터 통합 오디오-비디오 생성 모델.

TNTwise/REAL-Video-Enhancer

다양한 전용 모델과 다중 GPU 백엔드를 지원하는 AI 기반 동영상 프레임 보간 및 확대를 위한 크로스플랫폼 GUI 애플리케이션입니다.

HKUDS/VideoAgent

자연어 프롬프트를 통해 창의적인 비디오를 이해하고, 편집하고, 생성하는 올인원 에이전시 프레임워크.

OpenImagingLab/FlashVSR

FlashVSR는 초고해상도까지 확장 가능하고 고속 업스케일링을 실현하는 실시간 동영상 슈퍼레졸루션을 위한 1단계 스트리밍 확산 프레임워크입니다.

pyang5166/gbro-collage-broll

짧은 음성 내레이션을 세 단계 승인 워크플로우와 Gemini Omni Flash를 사용해 편집 스타일의 하프톤 종이 콜라주 B롤 애니메이션으로 변환하는 도구입니다.

pexoai/pexo-skills

텍스트, 이미지 또는 URL을 입력으로 받아 음악과 자막이 포함된 다중 샷 동영상으로 자동 변환하는 오픈소스 에이전트 기술 세트입니다.

xiejunjie524/handdraw-story-video

손그림 선화에서 색상 이미지로의 전환을 애니메이션화하여, 짧은 세로형 스토리 비디오를 생성하는 도구.

huangserva/ComfyUI_MiniMaxH3_Director

MiniMax H3 Director를 위한 ComfyUI 워크플로우 모음으로, 텍스트-to-비디오, 이미지-to-비디오 및 참조 자료를 활용한 고급 비디오-to-비디오 편집을 지원합니다.

Vchitect/VBench

VBench는 수십 가지의 품질 차원(기술적, 미학적, 신뢰성)에 걸쳐 비디오 생성 모델을 자동으로 평가하는 오픈소스 벤치마크 스위트입니다. 프롬프트 컬렉션, 메트릭 파이프라인, 인간의 선호도와 일치하는 점수, 그리고 T2V, I2V, 롱 비디오, 그리고 내재적 충실도 평가를 위한 공개 리더보드가 포함되어 있습니다.

Agents365-ai/video-podcast-maker

AI 리서치, TTS 오디오, Remotion 기반 비디오 렌더링을 통합하여 주제에서 전문적인 4K 동영상 팟캐스트를 자동으로 생성하는 파이프라인.

twinnydotdev/twinny

Twinny는 AI 기반 코드 완성, 인터랙티브 채팅 사이드바, 임베딩을 통한 워크스페이스 전체 컨텍스트 및 선택적 P2P 추론 공유 기능을 추가해 주는 무료 VS Code 확장 프로그램입니다. 여러 LLM 제공업체(OpenAI, Anthropic, Mistral 등)와 함께 작동하며 로컬로 실행할 수 있어, 사용자 정의 프롬프트와 diff 보기, 커밋 메시지 생성, 오프라인 작동과 같은 기능을 제공합니다.

Anil-matcha/Open-AI-UGC

Arcads와 MakeUGC의 대안으로, 여러 최첨단 동영상 모델을 사용할 수 있는 자체 호스팅 가능한 오픈소스 AI 동영상 광고 스튜디오입니다.

s1dashu/director

director 는 언어 모델이 전체 동영상 제작 프로세스(스크립트, 비주얼 스타일, 캐릭터, 목소리, 장면별 프롬프트)를 안내하고 LibTV 또는 即梦 CLI 도구를 사용해 편집 가능한 동영상 클립을 생성하는 AI 에이전트 기능입니다. 3가지 모드(애니메이션 설명서, 스토리타임 애니메이션, 시네마틱 드라마)를 지원하며, Codex와 같은 에이전트에 기능 디렉터리로 설치됩니다.