xixihhhh/clipforge
ClipForge是一款開源AI工具,可將單張產品圖片(或簡短文字提示)自動轉換為適用於Douyin、Kuaishou、Xiaohongshu、TikTok等平台的 ready-to-publish 短影片。它自動化完成腳本撰寫、故事板生成、圖像到影片合成、TTS、字幕、BGM及最終FFmpeg拼接。提供兩條路徑——完全免費路徑(使用公開資源和Edge TTS)與按生成內容秒數計費的付費AI生成路徑。功能包括導演/初學者模式、跨鏡頭一致性、選擇性重生成、391個模板庫、熱門話題自動生成功能、批量生產、內建合規性(AIGC標註、廣告法禁用詞掃描)、CLI/MCP/Agent整合,以及AGPL-3.0許可。非常適合需要快速、低成本製作產品影片的電商賣家、行銷人員、創作者和開發者。
xhongc/ai_story
AI Story 是一個基於 Docker 的網頁應用程式,能自動化從故事提示到完成短影片的整個流程,使用多個 AI 模型進行劇本撰寫、故事板創建、影像生成、攝影機移動規劃與影片渲染。
nkxx188/ComfyUI-MiniMaxH3-Easy
一個面向 ComfyUI 的實用節點套件,簡化 MiniMax H3 影片生成流程,提供統一媒體管理與基於上下文分段的長影片連貫性生成能力。
taco-group/SparkVSR
SparkVSR 是一個互動式影片超解析度框架,允許使用者透過稀疏的高品質關鍵幀引導還原過程,以確保更好的時間一致性與可控結果。
video-production-buddy/video-production-buddy
一種以代理為核心的AI影片製作流程,用受控的規劃、審批節點和驗證渲染流程取代單次提示,實現可審查、可重現的影片生成
yizhi-chengzi/video-ai-talking
一個本地 Web 應用,利用 Alibaba Bailian VideoRetalk 實現唇形同步,Bailian 或 Volcengine 的 TTS,可選的 DeepSeek 腳本生成,以及 FFmpeg 進行最終渲染,將無聲的面部攝影機影片轉換為完整的對話頭像影片。
LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler
為 Minimax H3 設計的自定義 ComfyUI 節點集,提供神經潛在空間放大與分塊重採樣,旨在加速高解析度影片生成,同時避免 VAE 往返開銷。
Carasibana/ComfyUI-H3-FaceRefine
ComfyUI‑H3‑FaceRefine 是 ComfyUI 的自訂節點套件,用於修復 MiniMax H3 在影片中對小臉渲染不佳的問題。它檢測臉部,將其裁剪至更大畫布,對裁剪區域執行 H3 模型進行優化,再縫合回原影片。包含自動與手動臉部選擇模式、硬切檢測、每幀去噪,以及開箱即用的範例工作流程。
pireel/pireel
Pireel Studio 是一個開源的 AI 影片編輯工具,讓使用者能結合手動時間軸編輯、基於聊天的描述與 AI 代理來製作影片。
NikoDemon80/ComfyUI-H3-Motion-Context
一個用於 MiniMax H3 的 ComfyUI 擴充,透過基於潛在空間的連續性,防止品質損失與運動、聲音跳躍,實現影片與音訊片段的無縫串接。
veedstudio/open-edit
一種由代理驅動的影片編輯流程,允許程式碼代理根據自然語言描述執行音訊轉錄、設計與 MP4 渲染。
KlingAIResearch/LivePortrait
一種高效的肖像動畫工具,透過驅動影片或圖像,對人類和動物的靜態圖像進行精確的縫合與重定向控制動畫處理。
Stonewuu/ai-fusion-video
一個將腳本撰寫、故事板製作和AI影像/影片生成整合到統一工作區的Agent驅動型影片創作平台。
MartinDelophy/ai-video-editor
Timeline Studio 是一款僅在瀏覽器中運行、以本地優先為設計原則的AI影片編輯器,基於 WebGPU/ONNX 建構。它提供多語言TTS、AI生成音樂、自動字幕、智慧構圖、水印移除、人聲分離、數位人像等能力,所有操作均無需上傳媒體。專案以可攜式的 `.timeline` 檔案儲存,可透過豐富的UI或支援LLM代理程式化檢查、規劃與應用編輯的無頭CLI技能進行編輯。程式碼採用MIT許可證;模型權重已鏡像至Hugging Face和ModelScope,遵循其原始許可證。
lcy362/agnes-video-generator
一款免費開源的AI影片生成工具,利用雲端API生成帶旁白與字幕的多場景影片,無需昂貴GPU或訂閱服務。
Lightricks/LTX-Desktop
LTX Desktop 是一個開源 Electron 應用,用於使用 LTX 擴散模型產生與編輯影片(及影像)。它在 NVIDIA GPU(≥16 GB VRAM)或 Apple Silicon Mac(≥15 GB 空閒 RAM)上本地執行,不支援的硬體會自動切換至付費雲端 API(LTX 2.5/2.3 Pro)。功能包括文字/影像/音訊轉影片、影片重拍/延長、LoRA 風格適配器、透過 Gemini 增強提示,以及基於時間軸的影片編輯器。透過 GitHub 發布安裝程式安裝;應用將資料儲存在標準 OS 專用資料夾中,並需要免費的 LTX API 金鑰用於雲端文字編碼。程式碼庫(Apache-2.0)分為 React UI、Electron 外殼與 Python FastAPI 後端,提供完整的本地建構開發指令碼。可選匿名遙測可停用。
zai-org/SCAIL-2
SCAIL-2 是一個開源模型,用於端到端角色動畫與替換,無需中間姿態表示,支援複雜動作與多樣身份。
FireRedTeam/FireRed-OpenStoryline
透過自然語言提示,自動完成腳本撰寫、媒體取得與編輯的對話式AI影片創作工具。
crisng95/flowkit
Flow Kit 是一個 Python‑FastAPI + Chrome 擴充系統,透過 Google Flow 自動化端到端 AI 影片創作,處理參考影像以維持視覺一致性,以及場景生成、TTS、升級、縮圖與 YouTube 上傳。
MeiGen-AI/OPSD-V
一種用於後訓練的在策略自我蒸餾框架,旨在減少長影片中的誤差累積並改善運動動態
Robbyant/lingbot-world
一個開源的世界模擬器,能夠生成具有即時互動性與長期時間一致性的高保真互動式影片環境。
liyue-aigc/seedance-2-5-video-director
一個用於 Dreamina/Jimeng Seedance 2.5 的影片導演技能,將創意和參考影像轉化為結構化的影片腳本和最佳化的提示詞。
nexu-io/html-video
利用本地編程代理和可插拔的 HTML 渲染引擎,將文本、文章或 GitHub 倉庫轉換為動畫 MP4 影片的元層。
Tencent-Hunyuan/HunyuanVideo
HunyuanVideo 是一個擁有超過 130 億參數的大規模開源影片基礎模型,能生成運動與文字對齊度卓越的高品質影片。
jnMetaCode/ai-shortfilm-prompts
一個為2026年文字轉影像模型量身打造的AI影片提示庫,以及一個Claude Code技能,可將任何構想快速轉化為即用型多鏡頭提示。包含類型模板、攝影機移動庫、負向提示預製件、無需安裝的網頁建構器,以及5階段提示結構的詳細文件。
myccarl/ai-shortVideo-pipeline
myAiVideos 是一個基於 Docker Compose 的開源系統,可自動化中文內容的短影片創作全流程(主題 → 腳本 → 視覺 → 音訊 → 後製 → 分發)。它採用 FastAPI 編排器 + Java Spring-Boot 網關(負責驗證、路由、熔斷與計量),並整合多個 LLM 與多模態模型(DeepSeek、GLM、Kling、TTS 服務)。該流程分層設計、具備故障轉移能力,且透過 Langfuse 與 Prometheus 實現全鏈路可觀測性。
ModelTC/LightX2V
LightX2V 是一個開源推理框架,用於快速生成影像與影片(T2V、I2V、T2I、I2I、T2AV 等)。支援多種先進模型(MiniMax-H3、Wan、HunyuanVideo、Qwen-Image 等),並提供 4 步蒸餾 LoRA、FP8/NVFP4 量化、張量/序列平行、跨多種硬體的解耦部署等加速技術。基準測試顯示,在 H100 GPU 上推論速度比競爭框架快達 3.9 倍。專案提供 Docker 鏡像、pip 安裝包、Gradio/ComfyUI 前端、詳盡文件與線上示範。
ChatCut-Inc/agent-plugin
一組外掛程式,讓 AI 編碼助手(Codex、Claude Code、Grok Bot、Cursor)能夠透過自然語言提示編輯 ChatCut 影片專案——匯入媒體、加入圖形、生成音訊、轉錄、匯出等。需要 ChatCut 帳戶和其中一個受支援的宿主;驗證透過 ChatCut 的 MCP 端點處理。
LingGuoAI/LingGuo-Drama
一個用於 AI 短劇與影片製作的開源工作台,管理從腳本撰寫、資產生成到最終影片合成的整個流程。
Rimagination/h3lite
MiniMax H3 的本地部署技能,讓 Windows 上的低 VRAM NVIDIA GPU 可透過 AI 代理生成帶原生音訊的影片。
jianjieyiban/JJYB_AI_VideoAutoCut
一款本地優先的 AI 影片創作工作站,可實現從素材分析、劇本編寫到配音生成及音畫同步的全流程自動化。
ChenShuo2004/cs-board
cs-board 是一個本地運行的 AI 影片創作工作站,能將中文文字、參考音訊與可選的風格/角色圖片,轉換為完整的白板風格 MP4。它支援語音克隆(透過 IndexTTS)、腳本分段、AI 生成插畫、手繪動畫、字幕與音畫同步,提供 12 種視覺模板、自訂角色/風格支援、動態資訊圖,以及基於區域網路的協作佇列。
zenstory-ai/video-recap-skills
一個AI驅動的影片摘要系統,透過自動化影片理解、腳本撰寫、語音合成與編輯,將原始影片轉換為帶旁白的摘要。
FujiwaraChoki/supoclip
一款開源、AI 驅動的影片剪輯工具,可將長影片自動轉換為適合傳播的直式剪輯,支援自動人臉裁切、字幕與病毒傳播評分。
HITsz-TMG/VideoClaw
一個從劇本創作、角色設計、分鏡規劃到最終編輯的完整創意影片製作流程自動化 AI 導演系統。
SandAI-org/MAGI-2-preview
一個擁有 114B 參數的統一音視頻生成模型,可以根據文本或圖像提示生成帶有同步聲音的 1080p 影片片段。
TNTwise/REAL-Video-Enhancer
一款支援多種 GPU 後端與多種專用模型的跨平台 GUI 應用程式,用於 AI 驅動的影片畫格插值與超解析度。
HKUDS/VideoAgent
一個全方位的代理式框架,透過自然語言提示來理解、編輯與產生創意影片。
OpenImagingLab/FlashVSR
FlashVSR 是一種用於即時影片超解析度的一步式串流擴散框架,實現高速上採樣與對超高解析度的可擴展性。
pyang5166/gbro-collage-broll
一個將短語音旁白自動轉換為編輯風格半調式紙張拼貼B-roll動畫的工具,採用三階段審核流程與 Gemini Omni Flash。
pexoai/pexo-skills
一組開源代理技能,可自動化完整的影片製作流程,將文字、圖片或URL轉換為帶音樂與字幕的多鏡頭成品影片。
xiejunjie524/handdraw-story-video
一種透過動畫化從手繪線稿到彩色圖像的過渡,來創建短直向故事影片的工具。
huangserva/ComfyUI_MiniMaxH3_Director
用於 MiniMax H3 Director 的 ComfyUI 工作流集合,支援文本生成影片、圖像生成影片以及基於參考資料的高級影片轉影片編輯。
Vchitect/VBench
VBench 是一個開源基準測試套件,能自動從數十個品質維度(技術、美學、可信度)評估影片生成模型。它包含提示詞集合、指標管道、符合人體感知的評估分數,以及針對 T2V、I2V、長影片和內在忠實度評估的公開排行榜。
Agents365-ai/video-podcast-maker
透過整合AI研究、TTS音訊與基於Remotion的影片渲染,將一個主題自動轉換為專業4K影片播客的自動化流程。
twinnydotdev/twinny
Twinny 是一款免費的 VS Code 擴充功能,提供 AI 驅動的程式碼補全、互動式聊天側邊欄、透過嵌入向量提供的全工作區上下文,以及可選的 P2P 推論共享。它支援多種 LLM 提供商(OpenAI, Anthropic, Mistral 等),並可本地運行,提供可自定義的提示詞與 diff view、提交訊息生成、離線操作等功能。
Anil-matcha/Open-AI-UGC
一個開源 AI 影片廣告工作室,可使用多個 SOTA 影片模型創建逼真的 UGC 直式廣告,作為 Arcads 和 MakeUGC 的可自託管替代方案。
s1dashu/director
director 是一個AI代理技能,可引導語言模型完成從劇本、視覺風格、角色、聲音、逐鏡提示到影片生成的完整影片製作流程,並使用LibTV或即夢CLI工具生成可直接編輯的影片片段。支援三種模式(動畫解說、故事時間動畫、電影劇集),可作為技能目錄安裝至Codex等代理。