Dooy/chatgpt-web-midjourney-proxy
One UI is all done with chatgpt web, midjourney, gpts,suno,luma,runway,viggle,flux,ideogram,realtime,pika,udio; Simultaneous support Web / PWA / Linux / Win / MacOS platform
ChatGPT-Web-Midjourney-Proxy
簡介 – 這是一個開源網頁 UI,整合了 OpenAI 的 ChatGPT(包含 GPT-4-vision、Whisper、TTS 以及全新的 gpts store)與多種生成式 AI 後端,例如 Midjourney、Stable Diffusion 風格圖像模型(Flux、DALL·E)、影片生成器(Luma、Runway、Pika、Kling)、音樂生成器(Suno、Udio、Riffusion)、舞蹈生成(Viggle)以及透過 InsightFace 進行的換臉功能。此 UI 允許您切換 API、上傳檔案,並在同一個聊天介面中進行文字、圖像、音訊與影片創作。
主要功能
- 具備自訂 API key/base-url、多輪對話上下文以及可選的 GPT-4-vision 圖像上傳功能的 ChatGPT 聊天。
- 即時語音輸入(瀏覽器 ASR)與基於 Whisper 的轉錄,以及 TTS 輸出。
- 直接控制 Midjourney:生成圖像、放大、變體、局部重繪、縮放、擴展畫布、混合種子,並可在標準機器人與 niji 機器人之間切換。同時支援
midjourney-proxy與midjourney-proxy-plusAPI。 - 整合式多模態生成器:
- 音訊 – Udio(文字轉音樂)、Suno(歌詞與風格控制、音訊轉音訊)。
- 影片 – Luma、Runway、Pika、Kling(文字轉影片與圖像轉影片)。
- 舞蹈 – Viggle。
- 圖像 – Flux、DALL·E-3、Ideogram,以及圖像轉圖像變體。
- 用於切換自訂模型端點的「GPT-Store」(gpts) UI。
- 透過
localforage進行本地檔案儲存;可選 Cloudflare R2 或自訂上傳器。 - 安全功能:可選的密碼保護、暴力破解鎖定,以及基於環境變數的密鑰處理。
如何執行
- Docker(推薦以獲得完整功能) – 拉取映像檔
ydlhero/chatgpt-web-midjourney-proxy並提供所需的環境變數(OpenAI key、Midjourney proxy URL/secret、Suno/Luma 端點等)。範例指令位於 README 中。 - Vercel 一鍵部署 – 點擊 Vercel 按鈕;在 Vercel UI 中設定
OPENAI_API_BASE_URL、OPENAI_API_KEY、MJ_SERVER與MJ_API_SECRET。 - 桌面/伺服器二進位檔案 – 從 GitHub releases 頁面下載對應版本,並使用相同的環境變數執行該執行檔。
設定 – 所有行為皆由環境變數驅動。重點項目:
OPENAI_API_*– OpenAI 端點與金鑰。MJ_SERVER/MJ_API_SECRET– Midjourney 代理。SUNO_SERVER/SUNO_KEY– Suno 音樂 API。LUMA_SERVER/LUMA_KEY– Luma 影片 API。CUSTOM_MODELS– 額外模型 ID 的白名單。AUTH_SECRET_*– 簡易密碼保護與暴力破解限制。UPLOAD_TYPE– 選擇上傳檔案的儲存位置(R2、本地容器、自訂 URL)。
適用對象 – 想要一個單一瀏覽器儀表板來體驗多種生成式 AI 服務,而無需切換不同前端或 API 客戶端的用戶。對於需要快速 UI 來測試文字、圖像、音訊與影片模型提示詞的開發者也很有用。
授權 – MIT (參閱 license 檔案)。
以上所有細節均直接取自儲存庫的 README;未推論任何額外功能。
相關
- 專案
- 專案
- 專案
- 專案