s1dashu/director

Direct complete videos with multi-mode workflows for research, scripts, visual development, shot design, media generation, and delivery.

director – 端到端视频创作的AI驱动“导演”技能

是什么director 是一个 Agent Skill,让语言模型能够扮演视频导演的角色。从一个简短的提示(主题、个人故事或完成的脚本)开始,该技能引导模型完成内容规划、脚本撰写、视觉风格选择、角色与声音设计、逐镜头提示生成,最终生成可直接编辑的视频片段。

为何重要 – 大多数AI视频工具仅停留在单个片段或分镜稿。director 将整个制作流程串联起来,让用户能够与LLM协作,无需手动处理每个步骤,即可生成完整、连贯的视频(动画解说、个人故事动画或短篇电影剧集)。


核心功能

模式 目标 典型输出
动画解说 将抽象概念转化为视觉隐喻和动画解释。 2分钟的教育视频,采用手绘或风格化动画。
故事时间动画 将个人轶事转化为结合旁白与情景再现的叙述性动画。 尊重隐私边界、保持一致旁白声音的叙事驱动动画。
电影剧集 从预写脚本中生成短篇AI驱动的电影或微电影。 多场景、15秒分段的视频,角色、场景和配音演员保持一致。

三种模式共享同一工作流:

  1. 想法与受众定义
  2. 调研 / 脚本草稿
  3. 角色与视觉风格选择(从内置风格库中选择或描述自定义外观)
  4. 声音 / 音效设计(从内部声音库中选择或生成新声音)
  5. 逐镜头提示生成
  6. 通过支持的CLI工具生成片段(LibTV 或 即梦)
  7. 审查与最终剪辑 – 该技能返回一组可直接剪辑的视频文件。

内部工作原理

  • 该技能是一组提示和辅助脚本,LLM(如Codex)可通过 $director 命令调用。
  • 媒体生成由外部CLI工具处理:
    • LibTV CLI – 文本到视频模型的命令行接口。
    • 即梦 (Jimeng) CLI – 另一个文本到视频后端。
  • 该技能将参考资产(角色设计、声音预设、风格表)存储在 references/ 文件夹中,LLM可在会话期间查询。
  • 用户可通过将仓库克隆到代理的 skills 目录,或在Codex中执行一行命令安装该技能:从 https://github.com/s1dashu/director 安装 director skill

快速上手

  1. 安装 – 克隆仓库或使用上方所示的Codex快捷方式。
  2. 调用 – 在兼容的代理中,输入 $director 后跟自然语言请求,例如:
    使用 director 创作一支两分钟动画科普视频,主题是"为什么人会拖延"。语气温柔,使用手绘风格,先和我确认讲稿与视觉方向。
    
  3. 代理将:
    • 提出澄清问题,
    • 提出脚本和视觉风格建议,
    • 生成分段提示,
    • 调用选定的CLI生成视频片段,
    • 返回片段供您组装。

适用人群

  • 希望获得AI辅助完成全流程视频制作而非孤立片段的内容创作者。
  • 需要快速生成动画解说的教育者与营销人员。
  • 希望用AI生成素材原型短篇剧集的独立电影人。
  • 需要即插即用“视频导演”技能集成到机器人中的AI代理开发者。

许可与贡献

  • 仓库的原始代码和资产在 MIT 许可证 下发布。
  • 第三方参考保留其各自许可证。
  • 欢迎贡献 – 给仓库点星,试用该技能,并提交问题或拉取请求。

快速链接

  • [Agent Skill 定义 – SKILL.md]$director 命令的正式描述。
  • [LibTV CLI 文档] – 该技能如何与视频模型通信。
  • [即梦 CLI 文档] – 替代后端。
  • [参考资产库] – 内置角色与声音预设。

核心价值director 将提示工程、资产管理和视频生成后端整合为单一、可由LLM调用的技能,让您从创意到最终片段共同创作完整视频。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目