s1dashu/director
Direct complete videos with multi-mode workflows for research, scripts, visual development, shot design, media generation, and delivery.
director – 端到端视频创作的AI驱动“导演”技能
是什么 – director 是一个 Agent Skill,让语言模型能够扮演视频导演的角色。从一个简短的提示(主题、个人故事或完成的脚本)开始,该技能引导模型完成内容规划、脚本撰写、视觉风格选择、角色与声音设计、逐镜头提示生成,最终生成可直接编辑的视频片段。
为何重要 – 大多数AI视频工具仅停留在单个片段或分镜稿。director 将整个制作流程串联起来,让用户能够与LLM协作,无需手动处理每个步骤,即可生成完整、连贯的视频(动画解说、个人故事动画或短篇电影剧集)。
核心功能
| 模式 | 目标 | 典型输出 |
|---|---|---|
| 动画解说 | 将抽象概念转化为视觉隐喻和动画解释。 | 2分钟的教育视频,采用手绘或风格化动画。 |
| 故事时间动画 | 将个人轶事转化为结合旁白与情景再现的叙述性动画。 | 尊重隐私边界、保持一致旁白声音的叙事驱动动画。 |
| 电影剧集 | 从预写脚本中生成短篇AI驱动的电影或微电影。 | 多场景、15秒分段的视频,角色、场景和配音演员保持一致。 |
三种模式共享同一工作流:
- 想法与受众定义
- 调研 / 脚本草稿
- 角色与视觉风格选择(从内置风格库中选择或描述自定义外观)
- 声音 / 音效设计(从内部声音库中选择或生成新声音)
- 逐镜头提示生成
- 通过支持的CLI工具生成片段(LibTV 或 即梦)
- 审查与最终剪辑 – 该技能返回一组可直接剪辑的视频文件。
内部工作原理
- 该技能是一组提示和辅助脚本,LLM(如Codex)可通过
$director命令调用。 - 媒体生成由外部CLI工具处理:
- LibTV CLI – 文本到视频模型的命令行接口。
- 即梦 (Jimeng) CLI – 另一个文本到视频后端。
- 该技能将参考资产(角色设计、声音预设、风格表)存储在
references/文件夹中,LLM可在会话期间查询。 - 用户可通过将仓库克隆到代理的 skills 目录,或在Codex中执行一行命令安装该技能:
从 https://github.com/s1dashu/director 安装 director skill。
快速上手
- 安装 – 克隆仓库或使用上方所示的Codex快捷方式。
- 调用 – 在兼容的代理中,输入
$director后跟自然语言请求,例如:使用 director 创作一支两分钟动画科普视频,主题是"为什么人会拖延"。语气温柔,使用手绘风格,先和我确认讲稿与视觉方向。 - 代理将:
- 提出澄清问题,
- 提出脚本和视觉风格建议,
- 生成分段提示,
- 调用选定的CLI生成视频片段,
- 返回片段供您组装。
适用人群
- 希望获得AI辅助完成全流程视频制作而非孤立片段的内容创作者。
- 需要快速生成动画解说的教育者与营销人员。
- 希望用AI生成素材原型短篇剧集的独立电影人。
- 需要即插即用“视频导演”技能集成到机器人中的AI代理开发者。
许可与贡献
- 仓库的原始代码和资产在 MIT 许可证 下发布。
- 第三方参考保留其各自许可证。
- 欢迎贡献 – 给仓库点星,试用该技能,并提交问题或拉取请求。
快速链接
- [Agent Skill 定义 – SKILL.md] –
$director命令的正式描述。 - [LibTV CLI 文档] – 该技能如何与视频模型通信。
- [即梦 CLI 文档] – 替代后端。
- [参考资产库] – 内置角色与声音预设。
核心价值 – director 将提示工程、资产管理和视频生成后端整合为单一、可由LLM调用的技能,让您从创意到最终片段共同创作完整视频。
相关
- 项目
- 项目
- 项目
- 项目
- 项目