cclank/lanshu-create-ai-presenter-video
Provider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.
解決的問題
本專案提供一個通用的工作流程,用於製作由AI驅動的數位人演示影片。它自動化了將主題或腳本以及一個人物的參考影像轉換為完整編輯影片的複雜過程,該影片包含一個數位化身,能同步口型說出文字,並附帶字幕與視覺效果。
如何運作
此系統作為 Codex 的「技能」運作,協調多種 AI 能力(語音生成、影片生成、口型同步),但不綁定於特定的服務供應商。該流程依據音訊軌道遵循嚴格的時間軸:
- 準備階段:輸入腳本與授權的參考影像。
- 生成階段:產生完整的旁白,作為整個影片的主時間軸。
- 製作階段:產生數位人影片,確保口型與音訊精確同步。
- 後製階段:加入字幕、關鍵字動畫與封面,再使用 FFmpeg 渲染最終影片。
- 品質保證階段:在輸出最終主版本與分享版本前,進行技術與人工檢查,確保音畫同步與品質。
適用對象
希望在不手動協調多個 AI 工具的情況下,製作專業級數位人演示影片的 Codex 相容代理環境之內容創作者與使用者。
主要亮點
- 供應商中立:不依賴特定模型或私有 API,可自由使用目前環境中可用的任何工具。
- 以音訊為中心的時間軸:使用完整旁白作為主要時間參考,防止口型漂移並實現無縫過渡。
- 自動化流程:從腳本整理、旁白生成到編輯、渲染與 QA 報告,全程自動化處理。
- 安全與成本控制:內建影像/語音授權檢查與付費生成前的成本估算功能。
相關
- 專案
- 專案
- 專案
- 專案
- 專案