Dooy/chatgpt-web-midjourney-proxy

One UI is all done with chatgpt web, midjourney, gpts,suno,luma,runway,viggle,flux,ideogram,realtime,pika,udio; Simultaneous support Web / PWA / Linux / Win / MacOS platform

ChatGPT-Web-Midjourney-Proxy

簡介 – 這是一個開源網頁 UI,整合了 OpenAI 的 ChatGPT(包含 GPT-4-vision、Whisper、TTS 以及全新的 gpts store)與多種生成式 AI 後端,例如 Midjourney、Stable Diffusion 風格圖像模型(Flux、DALL·E)、影片生成器(Luma、Runway、Pika、Kling)、音樂生成器(Suno、Udio、Riffusion)、舞蹈生成(Viggle)以及透過 InsightFace 進行的換臉功能。此 UI 允許您切換 API、上傳檔案,並在同一個聊天介面中進行文字、圖像、音訊與影片創作。

主要功能

  • 具備自訂 API key/base-url、多輪對話上下文以及可選的 GPT-4-vision 圖像上傳功能的 ChatGPT 聊天。
  • 即時語音輸入(瀏覽器 ASR)與基於 Whisper 的轉錄,以及 TTS 輸出。
  • 直接控制 Midjourney:生成圖像、放大、變體、局部重繪、縮放、擴展畫布、混合種子,並可在標準機器人與 niji 機器人之間切換。同時支援 midjourney-proxymidjourney-proxy-plus API。
  • 整合式多模態生成器:
    • 音訊 – Udio(文字轉音樂)、Suno(歌詞與風格控制、音訊轉音訊)。
    • 影片 – Luma、Runway、Pika、Kling(文字轉影片與圖像轉影片)。
    • 舞蹈 – Viggle。
    • 圖像 – Flux、DALL·E-3、Ideogram,以及圖像轉圖像變體。
  • 用於切換自訂模型端點的「GPT-Store」(gpts) UI。
  • 透過 localforage 進行本地檔案儲存;可選 Cloudflare R2 或自訂上傳器。
  • 安全功能:可選的密碼保護、暴力破解鎖定,以及基於環境變數的密鑰處理。

如何執行

  1. Docker(推薦以獲得完整功能) – 拉取映像檔 ydlhero/chatgpt-web-midjourney-proxy 並提供所需的環境變數(OpenAI key、Midjourney proxy URL/secret、Suno/Luma 端點等)。範例指令位於 README 中。
  2. Vercel 一鍵部署 – 點擊 Vercel 按鈕;在 Vercel UI 中設定 OPENAI_API_BASE_URLOPENAI_API_KEYMJ_SERVERMJ_API_SECRET
  3. 桌面/伺服器二進位檔案 – 從 GitHub releases 頁面下載對應版本,並使用相同的環境變數執行該執行檔。

設定 – 所有行為皆由環境變數驅動。重點項目:

  • OPENAI_API_* – OpenAI 端點與金鑰。
  • MJ_SERVER / MJ_API_SECRET – Midjourney 代理。
  • SUNO_SERVER / SUNO_KEY – Suno 音樂 API。
  • LUMA_SERVER / LUMA_KEY – Luma 影片 API。
  • CUSTOM_MODELS – 額外模型 ID 的白名單。
  • AUTH_SECRET_* – 簡易密碼保護與暴力破解限制。
  • UPLOAD_TYPE – 選擇上傳檔案的儲存位置(R2、本地容器、自訂 URL)。

適用對象 – 想要一個單一瀏覽器儀表板來體驗多種生成式 AI 服務,而無需切換不同前端或 API 客戶端的用戶。對於需要快速 UI 來測試文字、圖像、音訊與影片模型提示詞的開發者也很有用。

授權 – MIT (參閱 license 檔案)。


以上所有細節均直接取自儲存庫的 README;未推論任何額外功能。

相關

  • 專案
  • 專案
  • 專案
  • 專案