s1dashu/director
Direct complete videos with multi-mode workflows for research, scripts, visual development, shot design, media generation, and delivery.
director – 端對端影片創作的AI驅動「導演」技能
是什麼 – director 是一個 Agent Skill,讓語言模型能扮演影片導演的角色。從一個簡短的提示(主題、個人故事或完成的劇本)開始,該技能引導模型完成內容規劃、劇本撰寫、視覺風格選擇、角色與聲音設計、逐鏡提示生成,最終生成可直接編輯的影片片段。
為何重要 – 多數AI影片工具僅停留在單一片段或分鏡稿。director 將整個製作流程串連起來,讓使用者能與LLM協作,無需手動處理每個步驟,即可生成完整、連貫的影片(動畫解說、個人故事動畫或短篇電影劇集)。
核心功能
| 模式 | 目標 | 典型輸出 |
|---|---|---|
| 動畫解說 | 將抽象概念轉化為視覺隱喻和動畫解釋。 | 2分鐘的教育影片,採用手繪或風格化動畫。 |
| 故事時間動畫 | 將個人軼事轉化為結合旁白與情境再現的敘事性動畫。 | 尊重隱私邊界、保持一致旁白聲音的敘事驅動動畫。 |
| 電影劇集 | 從預寫劇本中生成短篇AI驅動的電影或微電影。 | 多場景、15秒分段的影片,角色、場景和配音演員保持一致。 |
三種模式共享同一工作流程:
- 想法與受眾定義
- 研究 / 劇本草稿
- 角色與視覺風格選擇(從內建風格庫中選擇或描述自訂外觀)
- 聲音 / 音效設計(從內部聲音庫中選擇或生成新聲音)
- 逐鏡提示生成
- 透過支援的CLI工具產生片段(LibTV 或 即夢)
- 審查與最終剪輯 – 該技能返回一組可直接剪輯的影片檔案。
內部運作原理
- 該技能是一組提示和輔助腳本,LLM(如Codex)可透過
$director命令調用。 - 媒體生成由外部CLI工具處理:
- LibTV CLI – 文字到影片模型的命令列介面。
- 即夢 (Jimeng) CLI – 另一個文字到影片後端。
- 該技能將參考資產(角色設計、聲音預設、風格表)儲存在
references/檔案夾中,LLM可在會話期間查詢。 - 使用者可透過將倉儲克隆到代理的 skills 目錄,或在Codex中執行一行命令安裝該技能:
從 https://github.com/s1dashu/director 安裝 director skill。
快速上手
- 安裝 – 克隆倉儲或使用上方所示的Codex快捷方式。
- 呼叫 – 在相容的代理中,輸入
$director後跟自然語言請求,例如:使用 director 创作一支两分钟动画科普视频,主题是"为什么人会拖延"。语气温柔,使用手绘风格,先和我确认讲稿与视觉方向。 - 代理將:
- 提出澄清問題,
- 提出劇本和視覺風格建議,
- 生成分段提示,
- 呼叫選定的CLI生成影片片段,
- 返回片段供您組裝。
適用對象
- 希望獲得AI輔助完成全流程影片製作而非孤立片段的內容創作者。
- 需要快速生成動畫解說的教育者與行銷人員。
- 希望用AI生成素材原型短篇劇集的獨立電影人。
- 需要即插即用「影片導演」技能整合到機器人中的AI代理開發者。
許可與貢獻
- 倉儲的原始程式碼和資產在 MIT 許可證 下發布。
- 第三方參考保留其各自許可證。
- 歡迎貢獻 – 給倉儲點星,試用該技能,並提交問題或拉取請求。
快速連結
- [Agent Skill 定義 – SKILL.md] –
$director命令的正式描述。 - [LibTV CLI 文件] – 該技能如何與影片模型通訊。
- [即夢 CLI 文件] – 替代後端。
- [參考資產庫] – 內建角色與聲音預設。
核心價值 – director 將提示工程、資產管理與影片生成後端整合為單一、可由LLM呼叫的技能,讓您從創意到最終片段共同創作完整影片。
相關
- 專案
- 專案
- 專案
- 專案
- 專案