heygen-com/hyperframes

一个开源框架,可将 HTML、CSS 和可寻址动画转化为确定性 MP4 视频,专为 AI 编码代理自动化视频制作而设计。

harry0703/MoneyPrinterTurbo

一个自动化 AI 短视频生成工具,可将主题或关键词转化为包含脚本、配音、字幕和匹配画面的完整视频。

calesthio/OpenMontage

一个开源的、代理型的视频制作系统,可从文本提示自动完成研究、脚本编写、资产生成和编辑,实现从脚本到最终渲染的全流程自动化。

browser-use/video-use

一个开源AI视频编辑工具,允许用户通过聊天方式编辑原始视频素材,将视频转换为结构化文本和按需生成的视觉信息,供LLM处理。

Vincentwei1021/video-shotcraft

一个 AI 代理技能,利用 Remotion 将产品截图和文案转化为电影级推广视频,使用包含 157 张镜头配方卡的库。

jub0t/Concat

一款基于 Whisper 和 ffmpeg 的本地运行开源视频编辑器,作为 CapCut 的免费替代品,提供自动字幕和文本转语音等内置 AI 功能。

kaomei/stickman-video-director

一个 Codex 技能,可将文本转化为结构化的导演提案和针对 Gemini Omni Flash 优化的提示,用于创建风格一致的一分钟木偶动画。

Vincentwei1021/video-talkcraft

通过 Remotion 实现,将脚本和语音旁白转换为具备角色级音频同步和自动动态图形的高质量口播视频的 AI 代理技能。

samuelgursky/davinci-resolve-mcp

DaVinci Resolve MCP 是一个开源服务器,将 DaVinci Resolve Studio 的完整脚本 API 作为 JSON-over-HTTP 服务暴露。AI 代理可以调用高层级工具(项目创建、媒体导入、时间线编辑、调色、Fusion、Fairlight、渲染设置等),并接收统一的结果封装,实现安全、可审计的自动化。它通过正常的外部脚本接口与付费 Studio 版本配合使用,并包含一个基于 Lua 的桥梁以接入免费版。一个可选的基于 Node 的“高级”服务器可在离线状态下编辑 Resolve 项目文件。该包附带本地浏览器控制面板,并与多种 IDE 集成,使其成为本地 AI 后期制作助手的实用基础。

diffusionstudio/editor

一款使用 JSX 作为文档源的开源视频编辑器,支持 AI 代理通过专用 CLI 实现视频编辑、动态图形创建和媒体分析。

ATH-MaaS/Pixelle-Video

一款 AI 驱动的自动化短视频引擎,只需一个主题即可生成剧本、画面和配音,无需手动编辑即可创建完整的视频。

AIMixer/ComfyUI_MiniMaxH3_Director

一个 ComfyUI 插件,为 MiniMax H3 提供导演控制台,支持多段视频规划、同步音频生成及长视频 AI 的高级精炼工具。

veedstudio/open-edit

一个代理驱动的视频编辑流水线,允许用户通过代码代理使用自然语言命令进行视频剪辑、添加字幕和创建动态图形

fqscfqj/Y2A-Auto

Y2A‑Auto 是一个自托管的 Python/Flask 应用,可自动化下载 YouTube 视频,使用 Whisper/Voxtral + OpenAI 生成或翻译字幕,可选运行 AI 基础质量检查和内容审核,重新编码视频(CPU 或 GPU),并上传至 AcFun、Bilibili 或两者。它包含 Web UI、YouTube 频道/关键词监控、通知钩子、CookieCloud 同步和安全功能,可通过 Docker 或本地运行。

Junchao-cs/SolarWM

一个开源基础,用于构建交互式视频世界模型,能够从短训练片段生成长时间跨度、相机控制的视频。

OpenVDN/vdn-minimax-h3

VDN-Minimax-H3 (VDN-H3) 是一款基于 MiniMax H3 的混合注意力视频扩散模型。它增加了轻量级线性注意力分支与 LoRA 适配器,实现了一种接近实时的 768p 视频生成(例如,在单个 B200 GPU 上,约 11 秒生成 14 秒的片段)。该仓库提供了完整的训练脚本(四阶段配方)以及使用 FP8 和 FlashAttention-4 优化的推理代码,并附带详细的设置说明与性能表。

cosmo-wander-ai/cosmo-edge

CosmoEdge 1.1 是一款采用 Apache-2.0 许可证的 C++ 边缘 AI 引擎,专用于视频分析和视觉语言模型。它可在 Sophon (BM1688/CV186X)、Rockchip (RK3576/RV1126B) NPU 上运行,并通过 Docker 支持 x86/macOS,提供基于浏览器的流程构建器、REST/MQTT/WebSocket 集成,以及用于保护商业模型的“Model Guard”。该仓库包含用于构建特定设备运行时的 Docker 脚本、基准测试报告以及详尽的文档。

0xsline/OpenChatCut

一个开源、本地优先的 AI 视频编辑器,结合专业多轨时间线与对话式代理,实现可编辑的、代理驱动的视频制作。

Anil-matcha/AI-Youtube-Shorts-Generator

AI‑YouTube‑Shorts‑Generator 是一个开源的 Python 工具,可将长 YouTube 视频(或本地文件)自动转换为适用于 TikTok/Reels/YouTube Shorts 的竖向短片。它下载视频,使用 Whisper 进行转录,利用 LLM(OpenAI、Gemini 或 MuAPI 模型)对‘病毒式传播潜力’高的时刻进行评分,去重重叠候选,并自动将每个高光片段裁剪为 9:16(或任意比例)。提供两种模式:零配置 API 模式(将下载、转录、评分、裁剪委托给 MuAPI)和完全本地模式(运行 `yt‑dlp`、`faster‑whisper`、OpenCV/ffmpeg 并调用外部 LLM)。CLI 返回 MP4 文件,以及每个剪辑的评分、钩子语句和理由,还可输出详细 JSON 文件。MIT 许可,适合创作者、代理机构或开发者构建自己的剪辑 SaaS。

Alisa0808/vox-director

一种能够自动制作 Vox 风格纸质拼贴解说视频的智能体技能,涵盖从剧本、关键帧到动作和配音的所有环节。

gnipbao/story-to-handdrawn-video

一个将故事文本或图像转换为纵向手绘动画的工具,内置 20 种风格,可通过 AI 代理技能实现自动化。

gamedev-skills/awesome-gamedev-agent-skills

一个包含 73 个 AI-代理“技能”(引擎特定代码指南、专业领域、类型和工作流程模板)的库,以及一个能自动检测你的游戏引擎并仅加载所需部分的路由器,使 Claude、Cursor、Gemini-CLI 等代理能够按需生成游戏代码。

Emily2040/seedance-2.0

一个用于 AI 视频生成的代理技能,可将粗糙想法转化为有方向性的提示,管理拍摄规划、参考绑定和片段连贯性。

yizhi-chengzi/video-ai-talking

一个本地 Web 应用,利用 Alibaba Bailian VideoRetalk 实现唇形同步,Bailian 或 Volcengine 的 TTS,可选的 DeepSeek 脚本生成,以及 FFmpeg 进行最终渲染,将无声的面部摄像头视频转换为完整的对话头像视频。

nkxx188/ComfyUI-MiniMaxH3-Easy

一个针对 MiniMax H3 的紧凑 ComfyUI 界面,通过统一媒体输入系统简化文本到视频、图像到视频以及基于参考的视频生成。

AlayaLab/Evoke

一种三步、无CFG的世界模型,利用外部世界状态银行实现无限、高质量的视频生成,支持飞行中重提示和相机控制。

HKUDS/ViMax

ViMax 是一个开源、代理驱动的框架,可将文本想法、剧本或小说片段转化为完整的 AI 生成视频。它通过可配置的 LLM、图像和视频 API 实现脚本编写、分镜设计、角色一致性及最终渲染。支持终端 TUI 或浏览器端 Web UI;使用 `uv sync` 安装,配置 `configs/agent.local.yaml` 中的 API 密钥,然后运行 `vimax tui` 或 `npm run dev` 启动 UI。

zhouxiaoka/autoclip

一款 AI 驱动的视频剪辑工具,能够自动从 YouTube 和 Bilibili 下载视频,利用大型语言模型(LLM)分析内容提取亮点,并生成短视频合集。

ArcReel/ArcReel

一个开源、自托管的 AI 视频制作工作台,通过结构化的生成流水线将剧本和小说转化为具有一致性的短视频。

xixihhhh/clipforge

ClipForge是一款开源AI工具,可将单张产品图片(或简短文本提示)自动转换为适用于Douyin、Kuaishou、Xiaohongshu、TikTok等平台的 ready-to-publish 短视频。它自动化完成脚本撰写、故事板生成、图像到视频合成、TTS、字幕、BGM及最终FFmpeg拼接。提供两条路径——完全免费路径(使用公开资源和Edge TTS)与按生成内容秒数计费的付费AI生成路径。功能包括导演/初学者模式、跨镜头一致性、选择性重生成、391个模板库、热点话题自动生成功能、批量生产、内置合规性(AIGC标注、广告法禁用词扫描)、CLI/MCP/Agent集成,以及AGPL-3.0许可。非常适合需要快速、低成本制作产品视频的电商卖家、营销人员、创作者和开发者。

NikoDemon80/ComfyUI-H3-Motion-Context

一个用于 MiniMax H3 的 ComfyUI 扩展,通过基于潜在空间的连续性,防止质量损失和运动、声音跳跃,实现视频与音频片段的无缝串联。

LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler

一个为 Minimax H3 定制的 ComfyUI 节点集,提供神经潜变量上采样和分块重采样功能,加速高分辨率视频生成,同时避免 VAE 解码-编码循环的开销。

cartesiancs/cartcut

专注于运动图形和图层式编辑的AI驱动视频编辑器,提供自动字幕功能和高分辨率渲染。

GVCLab/PersonaLive

一种从单张参考图像和驱动视频生成无限长度表达性肖像动画的实时流式扩散框架。

Carasibana/ComfyUI-H3-FaceRefine

一个 ComfyUI 自定义节点集,通过检测、裁剪、重生成并重新拼接小脸,提升 MiniMax H3 视频中小脸的画质

xhongc/ai_story

AI Story 是一个基于 Docker 的网页应用,通过使用多个 AI 模型实现从故事提示到完成短视频的全流程自动化,涵盖脚本撰写、分镜创建、图像生成、摄像机运动规划和视频渲染。

palmier-io/palmier-pro

一款内置生成式 AI 和 MCP 支持的 macOS 视频编辑器,使 AI 代理能够直接在时间线上创建和编辑内容。

nexu-io/html-video

利用本地编程代理和可插拔的 HTML 渲染引擎,将文本、文章或 GitHub 仓库转换为动画 MP4 视频的元层。

huangserva/ComfyUI_MiniMaxH3_Director

用于 MiniMax H3 Director 的 ComfyUI 工作流集合,支持文本生成视频、图像生成视频以及基于参考资料的高级视频转视频编辑。

YILS-LIN/short-video-factory

一款基于AI的桌面工具,可从文本提示和视频片段自动生成产品营销和通用内容短视频

Huanshere/VideoLingo

一款利用 AI 生成专业级单行字幕和高质量语音的全功能视频翻译与配音工具。

hao-ai-lab/FastVideo

一个统一的训练后优化和实时推理框架,通过稀疏蒸馏和注意力优化加速视频生成。

liangdabiao/Seedance2-Storyboard-Generator

一种利用Claude Code和Seedance 2.0将故事转化为一致的多集视频系列的AI视频制作工作流程。

lcy362/agnes-video-generator

一款免费开源的AI视频生成器,利用云API从文本或图像生成带旁白和自动字幕的多场景视频,无需高端GPU。

jd-opensource/JoyAI-Video-Edit

一种利用自回归扩散技术,在帧到达时实时编辑直播视频流或上传视频的系统。

Stonewuu/ai-fusion-video

一个将脚本编写、故事板制作和AI图像/视频生成整合到统一工作区的Agent驱动型视频创作平台。

Lightricks/LTX-2

LTX-2 是一款基于 DiT 的音频-视频基础模型,能够从文本或图像提示生成高保真、同步的音频与视频。

huytranvan2010/AI-auto-generate-video

一个自动化流水线,利用 AI 进行脚本生成和确定性 HTML 到视频的渲染,将越南语文本文章转换为 9:16 的短视频。