hypit-ai/hypit

Hypit 是一个开源框架,允许 LLM 代理通过声明式 SVML 工作流克隆或生成视频。上传一个参考视频(或描述),AI 会构建完整的制作流水线——包括素材、字幕、B-roll、特效,并使用无头 Chromium 渲染。该系统支持低成本大规模变体生成、可插拔组件,以及可选的零成本渲染(无需外部 AI 调用)。通过 `npx skills add hypit-ai/hypit -g` 安装;然后在任意编码代理会话中使用 `/hypit` 技能创建或重混视频。采用宽松的 Apache-2.0 衍生许可证。

mcncarl/jianying-headless

一款适用于 macOS 上剪映专业版的本地自动化工具,可编程生成可编辑的视频草稿,并原生导出 MP4,以支持 AI 视频工作流程。

calesthio/OpenMontage

一个开源的、代理式的视频制作系统,可从纯文本提示自动完成研究、脚本编写、资产生成和编辑,生成专业级视频。

heygen-com/hyperframes

HyperFrames 是一个开源的 Node.js 框架,允许您使用普通 HTML + CSS(带特殊 `data-*` 时序属性)描述视频,并将其渲染为确定性的 MP4。它提供了一组 AI 编码代理(Claude、Gemini、Cursor 等)可加载的“技能”,因此 LLM 可被提示“创建一个 10 秒的产品介绍”,代理将自动生成 HTML、拉取资源、进行 lint 检查、预览,最后通过 CLI(`hyperframes render`)渲染。系统支持多种动画运行时(GSAP、Lottie、Three.js、CSS 等),统一的媒体管理器,可选的云/Lambda 渲染,以及可重用设计块的目录。非常适合 AI 驱动的视频生成流水线,以及希望采用以 Web 为先、代码为中心的视频创作工作流的设计师。

harry0703/MoneyPrinterTurbo

一个自动化 AI 短视频生成工具,可将主题或关键词转化为包含脚本、配音、字幕和匹配画面的完整视频。

jub0t/Concat

一款注重隐私的开源跨平台视频编辑器,提供离线 AI 字幕、语音和抠像功能,是 CapCut 的本地优先替代方案。

ArcReel/ArcReel

一个开源且可自托管的 AI 视频制作工作台,可将小说、剧本和产品资料转化为视觉一致、可控的短视频。

Vincentwei1021/video-shotcraft

一个 AI 代理技能,利用 Remotion 将产品截图和文案转化为电影级推广视频,使用包含 157 张镜头配方卡的库。

Vincentwei1021/anything2explainer

一个由 AI 驱动的流水线,通过 AI 代理编写 Remotion 代码,将主题或文档转换为带旁白的动态图形解说视频

dramaclaw/dramaclaw

DramaClaw 是一个基于 Docker 的自托管平台,可将剧本转化为 AI 生成的短片。它提供了一个用于图像、视频、音频和 3D 场景创作的节点式无限画布(XiaHua),以及一个处理摄制、剧集规划、分镜生成、配音、视频合成和导出的结构化流程(Series)。内置的 AI 助手(Xia Director)可以执行任务并建议后续步骤。所有繁重的模型推理均通过兼容 OpenAI 的网关进行路由,让您可以使用任何喜欢的供应商。该软件采用 Elastic 2.0 授权,只需标注“Powered by DramaClaw”即可进行商业使用。

zhouxiaoka/autoclip

一款 AI 驱动的视频剪辑工具,能够自动从 YouTube 和 Bilibili 下载视频,利用大型语言模型(LLM)分析内容提取亮点,并生成短视频合集。

eternityspring/reelbench-skills

一套专为 Claude Code 和 Codex 设计的技能,可自动化视频镜头分析并生成同步的视频信息叠加层。

browser-use/video-use

一个开源AI视频编辑工具,允许用户通过聊天方式编辑原始视频素材,将视频转换为结构化文本和按需生成的视觉信息,供LLM处理。

cosmo-wander-ai/cosmo-edge

CosmoEdge 1.1 是一款采用 Apache-2.0 许可证的 C++ 边缘 AI 引擎,专用于视频分析和视觉语言模型。它可在 Sophon (BM1688/CV186X)、Rockchip (RK3576/RV1126B) NPU 上运行,并通过 Docker 支持 x86/macOS,提供基于浏览器的流程构建器、REST/MQTT/WebSocket 集成,以及用于保护商业模型的“Model Guard”。该仓库包含用于构建特定设备运行时的 Docker 脚本、基准测试报告以及详尽的文档。

diffusionstudio/editor

专为 AI 代理设计的专业视频编辑器,将视频组合视为代码,使代理与人类能够通过双向 JSX 工作流协作编辑视频。

AIMixer/ComfyUI_MiniMaxH3_Director

一个 ComfyUI 插件,提供基于 UI 的“导演”节点,支持使用 MiniMax‑H3 模型进行多段视频生成,涵盖文本、图像、参考、视频到视频任务,音频生成,运动连续性,第二轮精炼,以及项目包的导入/导出。

luoluoluo22/jianying-editor-skill

一个为剪映(CapCut 中国版)设计的 AI 驱动自动化技能,允许用户通过自然语言创建包含脚本、语音、特效的完整视频草稿。

samuelgursky/davinci-resolve-mcp

DaVinci Resolve MCP 是一个开源服务器,将 DaVinci Resolve Studio 的完整脚本 API 作为 JSON-over-HTTP 服务暴露。AI 代理可以调用高层级工具(项目创建、媒体导入、时间线编辑、调色、Fusion、Fairlight、渲染设置等),并接收统一的结果封装,实现安全、可审计的自动化。它通过正常的外部脚本接口与付费 Studio 版本配合使用,并包含一个基于 Lua 的桥梁以接入免费版。一个可选的基于 Node 的“高级”服务器可在离线状态下编辑 Resolve 项目文件。该包附带本地浏览器控制面板,并与多种 IDE 集成,使其成为本地 AI 后期制作助手的实用基础。

ATH-MaaS/Pixelle-Video

一款 AI 驱动的自动化短视频引擎,只需一个主题即可生成剧本、画面和配音,无需手动编辑即可创建完整的视频。

Vincentwei1021/video-talkcraft

一种 AI 代理技能,可将脚本和配音转换为专业的解说视频,具有自动字符级音频同步和 108 个动态图形模板库。

kaomei/stickman-video-director

一个 Codex Skill,可将文本转换为结构化的导演提案,并为使用 Gemini Omni Flash 制作一致的一分钟火柴人动画优化提示词。

SkyNotSilent/awesome-MiniMax-H3-cases

一个由社区运营的 MiniMax H3 视频案例、完整提示和硬件特定教程的目录,具备可搜索的 Web UI、JSON 数据和 AI 代理技能;MIT 许可证,内容来源可追溯。

AlayaLab/Evoke

一个高速、三步骤的世界模型,利用外部世界状态库来生成一致且无尽的视频,并具备飞行中重新提示功能。

shengshu-ai/Vidu-S

一套实时互动视频生成模型,适用于高分辨率数字人、实时视频编辑和沉浸式空间视频。

thu-ml/TurboDiffusion

TurboDiffusion 是一个视频生成加速框架,通过注意力加速和时间步蒸馏,将端到端扩散生成速度提高 100-200 倍。

cartesiancs/cartcut

一款基于 AI 的视频编辑器,支持图层式编辑和运动图形工具,帮助创作者在无需使用重型软件的情况下制作专业级效果。

0xsline/OpenChatCut

一个开源、本地优先的 AI 视频编辑器,结合专业多轨时间线与对话式代理,实现可编辑的、代理驱动的视频制作。

letorig/video-generator-client

一个异步 Python 客户端和 Web UI,为多个视频生成提供商(包括 Seedance、Kling、MiniMax 和 Wan)提供统一接口。

shuyu-labs/BigBanana-AI-Director

BigBanana AI Director 是一个 Docker 部署的 Web 平台,可将脚本(甚至单句)转化为短片 / 动态漫画。它使用 AntSK 的文本、图像和视频模型,以起始和结束关键帧驱动每个镜头,通过 Veo 模型插值生成运动,并提供项目级资产库、镜头网格 UI 和简易时间线编辑器,支持最终导出。

hao-ai-lab/FastVideo

一个统一的训练后优化和实时推理框架,通过稀疏蒸馏和注意力优化加速视频生成。

Colafornia/short-video-generator-AI

一个开源Python工具,可从YouTube或本地视频自动创建竖屏短视频片段。它使用本地Whisper进行转录,使用LLM(OpenAI、Gemini或MuAPI)对病毒式时刻进行排名,可选地添加AI生成的钩子,并通过简单的CLI或本地Web UI渲染片段。

Junchao-cs/SolarWM

SolarWM 是一个开源框架,提供大规模相机标注视频数据集、三阶段训练配方以及现成的 5 B–33 B 视频世界模型检查点(Wan2.2、LTX-2.5、MiniMax-H3)。它允许您通过统一的 CLI 和完全文档化的流水线来训练和运行长时程交互式视频模型。

YILS-LIN/short-video-factory

一款基于AI的桌面工具,可从文本提示和视频片段自动生成产品营销和通用内容短视频

Alisa0808/vox-director

一种能够自动制作 Vox 风格纸质拼贴解说视频的智能体技能,涵盖从剧本、关键帧到动作和配音的所有环节。

gamedev-skills/awesome-gamedev-agent-skills

一个包含 73 个 AI-代理“技能”(引擎特定代码指南、专业领域、类型和工作流程模板)的库,以及一个能自动检测你的游戏引擎并仅加载所需部分的路由器,使 Claude、Cursor、Gemini-CLI 等代理能够按需生成游戏代码。

liangdabiao/Seedance2-Storyboard-Generator

一种利用Claude Code和Seedance 2.0将故事转化为一致的多集视频系列的AI视频制作工作流程。

nateherkai/hyperframes-student-kit

一个开源、AI辅助的视频编辑工具包,允许您通过自然语言提示向 Codex 或 Claude Code 发出编辑指令。它包含 14 个代理驱动的“技能”、400 多个运动图形卡片、场景模板、转录助手(ElevenLabs、Whisper)以及演示项目。安装 Node 22+、Git、FFmpeg 后,运行 `npm run demo`,使用 `$edit-video` 或 `/short-form-edit` 等命令即可剪除静音、修复错误,并生成 Reel 或 Shorts。可选 API 密钥可解锁云端转录和资产生成;否则将完全本地运行,使用合成数据。

fqscfqj/Y2A-Auto

Y2A‑Auto 是一个开源、Docker 就绪的流水线,可下载 YouTube 视频,可选运行 Whisper/Voxtral ASR,翻译并质量检查字幕,通过 OpenAI 生成标题/标签,使用 CPU 或 GPU 编码视频,并上传至 AcFun 和/或 bilibili。它包含 Flask Web UI、YouTube 监控、CookieCloud 同步、内容审核和多渠道通知支持,所有配置通过 JSON 文件完成,并受密码/锁定功能保护。

Lightricks/LTX-2

LTX-2 是一款基于 DiT 的音频-视频基础模型,能够从文本或图像提示生成高保真、同步的音频与视频。

Emily2040/seedance-2.0

一个用于 AI 视频生成的代理技能,可将粗糙想法转化为有方向性的提示,管理拍摄规划、参考绑定和片段连贯性。

Anil-matcha/AI-Youtube-Shorts-Generator

一个开源 AI 工具,利用 LLM 进行精彩片段检测,并透过 Whisper 进行转录,将长篇 YouTube 视频转换为病毒式垂直短视频。

Robbyant/lingbot-world-v2

LingBot‑World‑V2 是一个研究级视频生成模型,能够从文本提示中创建无限且可交互的世界。它提供快速(实时)和高质量变体(14 B 和 1.3 B),支持多样化的动作,并采用飞行员-导演代理架构。仓库提供推理代码、模型下载链接和快速入门指南;部署代码未公开。

palmier-io/palmier-pro

一款内置生成式 AI 和 MCP 支持的 macOS 视频编辑器,使 AI 代理能够直接在时间线上创建和编辑内容。

gnipbao/story-to-handdrawn-video

一个将故事文本或图像转换为纵向手绘动画的工具,内置 20 种风格,可通过 AI 代理技能实现自动化。

OpenVDN/vdn-minimax-h3

VDN-Minimax-H3 (VDN-H3) 是一款基于 MiniMax H3 的混合注意力视频扩散模型。它增加了轻量级线性注意力分支与 LoRA 适配器,实现了一种接近实时的 768p 视频生成(例如,在单个 B200 GPU 上,约 11 秒生成 14 秒的片段)。该仓库提供了完整的训练脚本(四阶段配方)以及使用 FP8 和 FlashAttention-4 优化的推理代码,并附带详细的设置说明与性能表。

MemeCalculate/moyin-creator

从剧本解析、角色一致性到批量视频生成,全面自动化整个流程的生产级AI电影制作工具

xixihhhh/clipforge

ClipForge是一款开源AI工具,可将单张产品图片(或简短文本提示)自动转换为适用于Douyin、Kuaishou、Xiaohongshu、TikTok等平台的 ready-to-publish 短视频。它自动化完成脚本撰写、故事板生成、图像到视频合成、TTS、字幕、BGM及最终FFmpeg拼接。提供两条路径——完全免费路径(使用公开资源和Edge TTS)与按生成内容秒数计费的付费AI生成路径。功能包括导演/初学者模式、跨镜头一致性、选择性重生成、391个模板库、热点话题自动生成功能、批量生产、内置合规性(AIGC标注、广告法禁用词扫描)、CLI/MCP/Agent集成,以及AGPL-3.0许可。非常适合需要快速、低成本制作产品视频的电商卖家、营销人员、创作者和开发者。

HKUDS/ViMax

ViMax 是一个代理式视频创作框架,可自动化从叙事规划和脚本编写到一致的多镜头视频生成的整个流程。