ningzimu/codex-ppt-skill
GPT-Image-2 PPT Generator Skill for Creating Image-Based PowerPoint Presentations in Codex and Other Skill-Compatible Agents
解決的問題
Codex PPT 技能旨在將文章、報告書、論文與課程筆記等長篇內容轉換為視覺上引人入勝的簡報投影片。它透過自動化大綱規劃、視覺風格選擇與投影片生成流程,解決了從零開始手動設計投影片的問題。
如何運作
此工具作為 AI 代理(如 Codex、Claude Code、OpenClaw 與 Hermes Agent)的「技能」運作。它遵循結構化、分階段的工作流程:
- 規劃:代理讀取輸入內容,並建立詳細的大綱(
outline.md),包含每頁的標題與關鍵要點。 - 風格:使用者確認一種視覺風格(可從 12 種內建預設中選擇,或從上傳的參考圖像/PDF 中分析自訂風格)。
- 生成:代理使用影像生成後端(如
gpt-image-2或其他 OpenAI 相容 API)將每張投影片生成為全頁影像。 - 組裝:本地 Python 指令碼(
assemble_ppt.py)將這些影像合併為最終的.pptx檔案,同時獨立的speech.md檔案提供配套的講者備註。
適用對象
- 研究人員與學生:從論文中建立學術防衛投影片或專案報告。
- 專業人士:用於商業報告、產品介紹與調查摘要。
- 教育工作者:將課程筆記轉換為教學材料。
- 技術撰寫者:將技術文章轉化為簡報投影片。
亮點
- 多代理相容性:可在支援
SKILL.md的多種代理(Codex、Claude Code、OpenClaw、Hermes Agent)上運作。 - 自訂風格複製:可分析上傳的影像或 PDF,複製特定的視覺元素、色彩與版面配置。
- 個人風格資料庫:允許使用者將成功的風格儲存至本機目錄(
~/.codex-ppt-skill/references/)以供未來重複使用。 - 整合講者備註:自動產生
speech.md檔案並嵌入 PowerPoint 備註區段。 - 影像導向方法:專注於高視覺衝擊力的「全頁影像」投影片,而非可編輯的文字框,確保一致的專業美學。
- 彈性輸入格式:支援 Markdown、PDF、Word 與純文字等多種格式。
相關
- 專案
- 專案
- 專案
- 專案
- 專案