xixihhhh/clipforge

ClipForge是一款开源AI工具,可将单张产品图片(或简短文本提示)自动转换为适用于Douyin、Kuaishou、Xiaohongshu、TikTok等平台的 ready-to-publish 短视频。它自动化完成脚本撰写、故事板生成、图像到视频合成、TTS、字幕、BGM及最终FFmpeg拼接。提供两条路径——完全免费路径(使用公开资源和Edge TTS)与按生成内容秒数计费的付费AI生成路径。功能包括导演/初学者模式、跨镜头一致性、选择性重生成、391个模板库、热点话题自动生成功能、批量生产、内置合规性(AIGC标注、广告法禁用词扫描)、CLI/MCP/Agent集成,以及AGPL-3.0许可。非常适合需要快速、低成本制作产品视频的电商卖家、营销人员、创作者和开发者。

xhongc/ai_story

AI Story 是一个基于 Docker 的网页应用,通过使用多个 AI 模型实现从故事提示到完成短视频的全流程自动化,涵盖脚本撰写、分镜创建、图像生成、摄像机运动规划和视频渲染。

nkxx188/ComfyUI-MiniMaxH3-Easy

一个面向 ComfyUI 的实用节点套件,简化 MiniMax H3 视频生成流程,提供统一媒体管理与基于上下文分段的长视频连贯性生成能力。

taco-group/SparkVSR

SparkVSR 是一个交互式视频超分辨率框架,允许用户通过稀疏的高质量关键帧引导恢复过程,以确保更好的时间一致性和可控结果。

video-production-buddy/video-production-buddy

一种以代理为核心的AI视频制作流程,用受控的规划、审批节点和验证渲染流程替代单次提示,实现可审查、可复现的视频生成

yizhi-chengzi/video-ai-talking

一个本地 Web 应用,利用 Alibaba Bailian VideoRetalk 实现唇形同步,Bailian 或 Volcengine 的 TTS,可选的 DeepSeek 脚本生成,以及 FFmpeg 进行最终渲染,将无声的面部摄像头视频转换为完整的对话头像视频。

LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler

一个为 Minimax H3 定制的 ComfyUI 节点集,提供神经潜变量上采样和分块重采样功能,加速高分辨率视频生成,同时避免 VAE 解码-编码循环的开销。

Carasibana/ComfyUI-H3-FaceRefine

ComfyUI‑H3‑FaceRefine 是 ComfyUI 的自定义节点包,用于修复 MiniMax H3 在视频中对小脸渲染不佳的问题。它检测人脸,将其裁剪至更大画布,对裁剪区域运行 H3 模型进行优化,再缝合回原视频。包含自动与手动人脸选择模式、硬切检测、每帧去噪,以及开箱即用的示例工作流。

pireel/pireel

Pireel Studio 是一个开源的 AI 视频编辑器,允许用户通过手动时间轴编辑、基于聊天的描述以及 AI 代理的组合方式创建视频。

NikoDemon80/ComfyUI-H3-Motion-Context

一个用于 MiniMax H3 的 ComfyUI 扩展,通过基于潜在空间的连续性,防止质量损失和运动、声音跳跃,实现视频与音频片段的无缝串联。

veedstudio/open-edit

一种由代理驱动的视频编辑流水线,允许代码代理根据自然语言描述执行音频转录、设计和 MP4 渲染。

KlingAIResearch/LivePortrait

一种高效的肖像动画工具,通过驱动视频或图像,对人类和动物的静态图像进行精确的缝合和重定向控制动画处理。

Stonewuu/ai-fusion-video

一个将脚本编写、故事板制作和AI图像/视频生成整合到统一工作区的Agent驱动型视频创作平台。

MartinDelophy/ai-video-editor

Timeline Studio 是一款仅在浏览器中运行、以本地优先为设计原则的AI视频编辑器,基于 WebGPU/ONNX 构建。它提供多语言TTS、AI生成音乐、自动字幕、智能构图、水印去除、人声分离、数字人形象等能力,所有操作均无需上传媒体。项目以可移植的 `.timeline` 文件保存,可通过丰富的UI或支持LLM代理程序化检查、规划与应用编辑的无头CLI技能进行编辑。代码采用MIT许可证;模型权重已镜像至Hugging Face和ModelScope,遵循其原始许可证。

lcy362/agnes-video-generator

一款免费开源的AI视频生成工具,利用云API生成带旁白和字幕的多场景视频,无需昂贵的GPU或订阅服务。

Lightricks/LTX-Desktop

LTX Desktop 是一个开源 Electron 应用,用于使用 LTX 扩散模型生成和编辑视频(及图像)。它在 NVIDIA GPU(≥16 GB VRAM)或 Apple Silicon Mac(≥15 GB 空闲 RAM)上本地运行,不支持的硬件会自动切换到付费云 API(LTX 2.5/2.3 Pro)。功能包括文本/图像/音频转视频、视频重拍/延长、LoRA 风格适配器、通过 Gemini 增强提示,以及基于时间线的视频编辑器。通过 GitHub 发布安装程序安装;应用将数据存储在标准 OS 专用文件夹中,并需要免费的 LTX API 密钥用于云文本编码。代码库(Apache-2.0)分为 React UI、Electron 外壳和 Python FastAPI 后端,提供完整的本地构建开发脚本。可选匿名遥测可禁用。

zai-org/SCAIL-2

SCAIL-2 是一个开源模型,用于端到端角色动画与替换,无需中间姿态表示,支持复杂动作和多样身份。

FireRedTeam/FireRed-OpenStoryline

通过自然语言提示,自动完成脚本编写、媒体获取和编辑的对话式AI视频创作工具。

crisng95/flowkit

Flow Kit 是一个 Python‑FastAPI + Chrome 扩展系统,通过 Google Flow 自动化端到端 AI 视频创作,处理参考图像以保持视觉一致性,以及场景生成、TTS、升级、缩略图和 YouTube 上传。

MeiGen-AI/OPSD-V

一种用于后训练的在线策略自我蒸馏框架,旨在减少长视频中误差累积并改善运动动态

Robbyant/lingbot-world

一个开源的世界模拟器,能够生成具有实时交互性和长期时间一致性的高保真交互式视频环境。

liyue-aigc/seedance-2-5-video-director

一个用于 Dreamina/Jimeng Seedance 2.5 的视频导演技能,将创意和参考图像转化为结构化的视频脚本和优化的提示词。

nexu-io/html-video

利用本地编程代理和可插拔的 HTML 渲染引擎,将文本、文章或 GitHub 仓库转换为动画 MP4 视频的元层。

Tencent-Hunyuan/HunyuanVideo

HunyuanVideo 是一个拥有超过 130 亿参数的大规模开源视频基础模型,能够生成运动和文本对齐度出色的高质量视频。

jnMetaCode/ai-shortfilm-prompts

一个为2026年文本到视频模型定制的AI视频提示库,以及一个Claude Code技能,可将任何创意快速转化为即用型多镜头提示。包含类型模板、相机运动库、负向提示预制件、无需安装的网页构建器,以及5阶段提示结构的详细文档。

myccarl/ai-shortVideo-pipeline

myAiVideos 是一个基于 Docker Compose 的开源系统,可自动化中文内容的短视频创作全流程(主题 → 脚本 → 视觉 → 音频 → 后期 → 分发)。它采用 FastAPI 编排器 + Java Spring-Boot 网关(负责认证、路由、熔断与计量),并集成多个 LLM 与多模态模型(DeepSeek、GLM、Kling、TTS 服务)。该流水线分层设计、具备故障转移能力,且通过 Langfuse 和 Prometheus 实现全链路可观测性。

ModelTC/LightX2V

LightX2V 是一个开源推理框架,用于快速生成图像和视频(T2V、I2V、T2I、I2I、T2AV 等)。支持众多前沿模型(MiniMax-H3、Wan、HunyuanVideo、Qwen-Image 等),并提供 4 步蒸馏 LoRA、FP8/NVFP4 量化、张量/序列并行、跨多种硬件的解耦部署等加速技术。基准测试显示,在 H100 GPU 上推理速度比竞品框架快达 3.9 倍。项目提供 Docker 镜像、pip 安装包、Gradio/ComfyUI 前端、详尽文档和在线演示。

ChatCut-Inc/agent-plugin

一组插件,让 AI 编码助手(Codex、Claude Code、Grok Bot、Cursor)能够通过自然语言提示编辑 ChatCut 视频项目——导入媒体、添加图形、生成音频、转录、导出等。需要 ChatCut 账户和其中一个受支持的宿主;身份验证通过 ChatCut 的 MCP 端点处理。

LingGuoAI/LingGuo-Drama

一个用于 AI 短剧和视频制作的开源工作台,管理从脚本编写、资产生成到最终视频合成的全流程。

Rimagination/h3lite

MiniMax H3 的本地部署技能,使 Windows 上的低 VRAM NVIDIA GPU 能够通过 AI 代理生成带原生音频的视频。

jianjieyiban/JJYB_AI_VideoAutoCut

一款本地优先的 AI 视频创作工作站,可实现从素材分析、剧本编写到配音生成及音画同步的全流程自动化。

zenstory-ai/video-recap-skills

一个AI驱动的视频摘要系统,通过自动化视频理解、脚本编写、语音合成和编辑,将原始视频转换为带旁白的摘要。

FujiwaraChoki/supoclip

一款开源、AI 驱动的视频剪辑工具,可将长视频自动转换为适合传播的竖屏剪辑,支持自动人脸裁剪、字幕和病毒传播评分。

HITsz-TMG/VideoClaw

一个从剧本创作、角色设计、分镜规划到最终编辑的完整创意视频制作流程自动化 AI 导演系统。

SandAI-org/MAGI-2-preview

一个拥有 114B 参数的统一音视频生成模型,可以根据文本或图像提示生成带有同步声音的 1080p 视频片段。

TNTwise/REAL-Video-Enhancer

一款支持多种 GPU 后端和多种专用模型的跨平台 GUI 应用程序,用于 AI 驱动的视频帧插值和超分辨率。

HKUDS/VideoAgent

一个全能的代理框架,通过自然语言提示来理解、编辑和生成创意视频。

OpenImagingLab/FlashVSR

FlashVSR 是一种用于实时视频超分辨率的一步式流式扩散框架,实现了高速上采样和对超高分辨率的可扩展性。

pyang5166/gbro-collage-broll

一个将短语音旁白自动转换为编辑风格半色调纸张拼贴B-roll动画的工具,采用三阶段审批流程与 Gemini Omni Flash。

pexoai/pexo-skills

一组开源代理技能,可自动化完整的视频制作流程,将文本、图像或URL转换为带音乐和字幕的多镜头成品视频。

xiejunjie524/handdraw-story-video

一种通过动画化从手绘线稿到彩色图像的过渡,来创建短竖屏故事视频的工具。

huangserva/ComfyUI_MiniMaxH3_Director

用于 MiniMax H3 Director 的 ComfyUI 工作流集合,支持文本生成视频、图像生成视频以及基于参考资料的高级视频转视频编辑。

Vchitect/VBench

VBench 是一款开源基准测试套件,可自动从数十个质量维度(技术、美学、可信度)评估视频生成模型。它包含提示词集合、指标管道、人类对齐的评分,以及针对 T2V、I2V、长视频和内在忠实度评估的公开排行榜。

Agents365-ai/video-podcast-maker

通过整合AI研究、TTS音频和基于Remotion的视频渲染,将一个主题自动转化为专业4K视频播客的自动化流水线。

twinnydotdev/twinny

Twinny 是一个免费的 VS Code 扩展,提供 AI 驱动的代码补全、交互式聊天侧边栏、通过嵌入实现的工作区级上下文,以及可选的 P2P 推理资源共享。它支持多种大语言模型提供商(OpenAI、Anthropic、Mistral 等),可在本地运行,提供可自定义的提示词和功能,如差异视图、提交信息生成和离线操作。

Anil-matcha/Open-AI-UGC

一个开源 AI 视频广告工作室,可使用多个 SOTA 视频模型创建逼真的 UGC 竖屏广告,作为 Arcads 和 MakeUGC 的可自托管替代方案。

s1dashu/director

director 是一个AI代理技能,可引导语言模型完成从脚本、视觉风格、角色、声音、逐镜头提示到视频生成的完整视频制作流程,并使用LibTV或即梦CLI工具生成可直接编辑的视频片段。支持三种模式(动画解说、故事时间动画、电影剧集),可作为技能目录安装至Codex等代理。

jd-opensource/JoyAI-Video-Edit

一种利用自回归扩散技术,在帧到达时实时编辑直播视频流或上传视频的系统。