yohasebe/openai-chat-api-workflow

🎩 An Alfred 5 Workflow for using OpenAI Chat API to interact with GPT models 🤖💬 It also allows image generation/editing/understanding 🖼️, speech-to-text conversion 🎤, and text-to-speech synthesis 🔈

何を解決するか

このプロジェクトは、macOS の Alfred 5 プロダクティビティアプリに OpenAI の GPT モデルを直接統合するシームレスな方法を提供します。AI 機能にアクセスするために異なるブラウザタブやアプリケーションを切り替える必要がなくなり、テキスト生成、画像作成、ファイル分析をシステムのワークフロー内に直接組み込みます。

動作方法

このワークフローは、ユーザーが提供する API キーを使って OpenAI Chat API に接続します。主に3つの方法で対話が可能です:Alfred UI 内での直接コマンド、ユニバーサルアクションによる選択テキストの渡し、およびより複雑な操作に適したローカルホストのウェブインターフェース。幅広い OpenAI モデルをサポートしており、推論能力を持つモデルも含み、画像、PDF、オーディオファイルなど、さまざまなモダリティを処理できます。

対象ユーザー

Alfred 5 を使用し、現在の作業環境を離れずに AI ベースのテキスト、画像、音声ツールを日常の生産性フローに統合したい macOS ユーザー。

主な特徴

  • マルチモーダル機能:画像生成、画像編集、ファイル理解(PDF、Officeドキュメント、コード)、音声認識/音声合成をサポート。
  • 柔軟なインターフェース:Alfred キーワード、ホットキー、選択テキスト、または専用のローカルウェブ UI からアクセス可能。
  • 反復的画像改善:生成された画像を後続のプロンプトで段階的に改善できる。
  • 推論制御:対応する GPT-5 シリーズモデルに対して「推論努力」の設定を調整可能。処理速度と品質のバランスを最適化。
  • プライバシー重視:API 呼び出しはワークフローと OpenAI の間で直接行われます。ローカルウェブ UI はユーザーの Mac 上で構築・実行されます。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • Dispatch
  • Dispatch