ningzimu/codex-ppt-skill

GPT-Image-2 PPT Generator Skill for Creating Image-Based PowerPoint Presentations in Codex and Other Skill-Compatible Agents

何を解決するか

Codex PPT Skill は、記事、報告書、論文、講義ノートなどの長文コンテンツを、視覚的に魅力的なプレゼンテーションスライドに変換するように設計されています。スライドを手動で作成する問題を解決するために、アウトラインの計画、ビジュアルスタイルの選択、スライド生成プロセスを自動化しています。

動作方法

このツールは、Codex、Claude Code、OpenClaw、Hermes Agent などの AI エージェントの「スキル」として動作します。構造的で段階的なワークフローに従います:

  1. 計画:エージェントは入力された資料を読み取り、各ページのタイトルとキーポイントを含む詳細なアウトライン(outline.md)を作成します。
  2. スタイル設定:ユーザーは、12種類の組み込みプリセットから、またはアップロードされた参照画像/PDFから分析されたカスタムスタイルを選択確認します。
  3. 生成:エージェントは画像生成バックエンド(gpt-image-2 または他の OpenAI 互換 API)を使用して、各スライドをフルページ画像として生成します。
  4. アセンブリ:ローカルの Python スクリプト(assemble_ppt.py)がこれらの画像を統合して最終的な .pptx ファイルを作成し、別途作成された speech.md ファイルがスピーカー用の補足メモを提供します。

対象ユーザー

  • 研究者および学生:論文から学術防衛用スライドやプロジェクト報告書を作成する場合。
  • プロフェッショナル:ビジネスレポート、製品紹介、調査要約の作成に。
  • 教育者:講義ノートを教材に変換する場合。
  • 技術ライター:技術記事をプレゼンテーション資料に変換する場合。

特徴

  • マルチエージェント互換性SKILL.md をサポートするさまざまなエージェント(Codex、Claude Code、OpenClaw、Hermes Agent)で動作可能。
  • カスタムスタイルの再現:アップロードされた画像や PDF を分析し、特定のビジュアル要素、色、レイアウトを再現可能。
  • 個人スタイルライブラリ:成功したスタイルをローカルディレクトリ(~/.codex-ppt-skill/references/)に保存し、将来の再利用が可能。
  • 統合スピーカー用メモ:自動的に speech.md ファイルを生成し、PowerPoint のノートセクションに埋め込み。
  • 画像ベースのアプローチ:編集可能なテキストボックスではなく、高視覚的インパクトを持つ「フルページ画像」スライドに焦点を当て、一貫したプロフェッショナルな外観を保証。
  • 柔軟な入力形式:Markdown、PDF、Word、およびプレーンテキストなど、幅広いフォーマットをサポート。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト