ningzimu/codex-ppt-skill
GPT-Image-2 PPT Generator Skill for Creating Image-Based PowerPoint Presentations in Codex and Other Skill-Compatible Agents
解决的问题
Codex PPT 技能旨在将文章、报告、论文和课程笔记等长篇内容转换为视觉上引人入胜的演示文稿幻灯片。它通过自动化大纲规划、视觉风格选择和幻灯片生成过程,解决了从零开始手动设计幻灯片的问题。
如何工作
该工具作为 AI 代理(如 Codex、Claude Code、OpenClaw 和 Hermes Agent)的“技能”运行。它遵循结构化、分阶段的工作流程:
- 规划:代理读取输入内容,并创建一个详细的提纲(
outline.md),包含每页的标题和关键要点。 - 样式:用户确认一种视觉风格(从 12 个内置预设中选择,或从上传的参考图像/PDF 中分析自定义风格)。
- 生成:代理使用图像生成后端(如
gpt-image-2或其他 OpenAI 兼容 API)将每张幻灯片生成为全页图像。 - 组装:本地 Python 脚本(
assemble_ppt.py)将这些图像合并为最终的.pptx文件,同时单独的speech.md文件提供配套的演讲者备注。
适用人群
- 研究人员和学生:从论文中创建学术答辩幻灯片或项目报告。
- 专业人士:用于商业报告、产品介绍和调查摘要。
- 教育工作者:将课程笔记转换为教学材料。
- 技术写作者:将技术文章转化为演示文稿。
亮点
- 多代理兼容性:可在支持
SKILL.md的多种代理(Codex、Claude Code、OpenClaw、Hermes Agent)上运行。 - 自定义风格复制:可分析上传的图像或 PDF,复制特定的视觉元素、颜色和布局。
- 个人风格库:允许用户将成功的风格保存到本地目录(
~/.codex-ppt-skill/references/)以供未来重复使用。 - 集成演讲者备注:自动生成
speech.md文件并嵌入 PowerPoint 备注部分。 - 基于图像的方法:专注于高视觉冲击力的“全页图像”幻灯片,而非可编辑的文本框,确保一致的专业外观。
- 灵活输入:支持 Markdown、PDF、Word 和纯文本等多种格式。
相关
- 项目
- 项目
- 项目
- 项目
- 项目