Dooy/chatgpt-web-midjourney-proxy

One UI is all done with chatgpt web, midjourney, gpts,suno,luma,runway,viggle,flux,ideogram,realtime,pika,udio; Simultaneous support Web / PWA / Linux / Win / MacOS platform

ChatGPT-Web-Midjourney-Proxy

简介 – 这是一个开源网页 UI,整合了 OpenAI 的 ChatGPT(包含 GPT-4-vision、Whisper、TTS 以及全新的 gpts store)与多种生成式 AI 后端,例如 Midjourney、Stable Diffusion 风格图像模型(Flux、DALL·E)、视频生成器(Luma、Runway、Pika、Kling)、音乐生成器(Suno、Udio、Riffusion)、舞蹈生成(Viggle)以及通过 InsightFace 进行的换脸功能。此 UI 允许您切换 API、上传文件,并在同一个聊天界面中进行文字、图像、音频与视频创作。

主要功能

  • 具备自定义 API key/base-url、多轮对话上下文以及可选的 GPT-4-vision 图像上传功能的 ChatGPT 聊天。
  • 实时语音输入(浏览器 ASR)与基于 Whisper 的转录,以及 TTS 输出。
  • 直接控制 Midjourney:生成图像、放大、变体、局部重绘、缩放、扩展画布、混合种子,并可在标准机器人与 niji 机器人之间切换。同时支持 midjourney-proxymidjourney-proxy-plus API。
  • 整合式多模态生成器:
    • 音频 – Udio(文字转音乐)、Suno(歌词与风格控制、音频转音频)。
    • 视频 – Luma、Runway、Pika、Kling(文字转视频与图像转视频)。
    • 舞蹈 – Viggle。
    • 图像 – Flux、DALL·E-3、Ideogram,以及图像转图像变体。
  • 用于切换自定义模型端点的“GPT-Store”(gpts) UI。
  • 通过 localforage 进行本地文件存储;可选 Cloudflare R2 或自定义上传器。
  • 安全功能:可选的密码保护、暴力破解锁定,以及基于环境变量的密钥处理。

如何运行

  1. Docker(推荐以获得完整功能) – 拉取镜像 ydlhero/chatgpt-web-midjourney-proxy 并提供所需的环境变量(OpenAI key、Midjourney proxy URL/secret、Suno/Luma 端点等)。示例指令位于 README 中。
  2. Vercel 一键部署 – 点击 Vercel 按钮;在 Vercel UI 中设置 OPENAI_API_BASE_URLOPENAI_API_KEYMJ_SERVERMJ_API_SECRET
  3. 桌面/服务器二进制文件 – 从 GitHub releases 页面下载对应版本,并使用相同的环境变量运行该可执行文件。

配置 – 所有行为皆由环境变量驱动。重点项目:

  • OPENAI_API_* – OpenAI 端点与密钥。
  • MJ_SERVER / MJ_API_SECRET – Midjourney 代理。
  • SUNO_SERVER / SUNO_KEY – Suno 音乐 API。
  • LUMA_SERVER / LUMA_KEY – Luma 视频 API。
  • CUSTOM_MODELS – 额外模型 ID 的白名单。
  • AUTH_SECRET_* – 简易密码保护与暴力破解限制。
  • UPLOAD_TYPE – 选择上传文件的存储位置(R2、本地容器、自定义 URL)。

适用对象 – 想要一个单一浏览器仪表板来体验多种生成式 AI 服务,而无需切换不同前端或 API 客户端的用户。对于需要快速 UI 来测试文字、图像、音频与视频模型提示词的开发者也很有用。

授权 – MIT (参阅 license 文件)。


以上所有细节均直接取自仓库的 README;未推论任何额外功能。

相关

  • 项目
  • 项目
  • 项目
  • 项目