Dooy/chatgpt-web-midjourney-proxy
One UI is all done with chatgpt web, midjourney, gpts,suno,luma,runway,viggle,flux,ideogram,realtime,pika,udio; Simultaneous support Web / PWA / Linux / Win / MacOS platform
ChatGPT-Web-Midjourney-Proxy
简介 – 这是一个开源网页 UI,整合了 OpenAI 的 ChatGPT(包含 GPT-4-vision、Whisper、TTS 以及全新的 gpts store)与多种生成式 AI 后端,例如 Midjourney、Stable Diffusion 风格图像模型(Flux、DALL·E)、视频生成器(Luma、Runway、Pika、Kling)、音乐生成器(Suno、Udio、Riffusion)、舞蹈生成(Viggle)以及通过 InsightFace 进行的换脸功能。此 UI 允许您切换 API、上传文件,并在同一个聊天界面中进行文字、图像、音频与视频创作。
主要功能
- 具备自定义 API key/base-url、多轮对话上下文以及可选的 GPT-4-vision 图像上传功能的 ChatGPT 聊天。
- 实时语音输入(浏览器 ASR)与基于 Whisper 的转录,以及 TTS 输出。
- 直接控制 Midjourney:生成图像、放大、变体、局部重绘、缩放、扩展画布、混合种子,并可在标准机器人与 niji 机器人之间切换。同时支持
midjourney-proxy与midjourney-proxy-plusAPI。 - 整合式多模态生成器:
- 音频 – Udio(文字转音乐)、Suno(歌词与风格控制、音频转音频)。
- 视频 – Luma、Runway、Pika、Kling(文字转视频与图像转视频)。
- 舞蹈 – Viggle。
- 图像 – Flux、DALL·E-3、Ideogram,以及图像转图像变体。
- 用于切换自定义模型端点的“GPT-Store”(gpts) UI。
- 通过
localforage进行本地文件存储;可选 Cloudflare R2 或自定义上传器。 - 安全功能:可选的密码保护、暴力破解锁定,以及基于环境变量的密钥处理。
如何运行
- Docker(推荐以获得完整功能) – 拉取镜像
ydlhero/chatgpt-web-midjourney-proxy并提供所需的环境变量(OpenAI key、Midjourney proxy URL/secret、Suno/Luma 端点等)。示例指令位于 README 中。 - Vercel 一键部署 – 点击 Vercel 按钮;在 Vercel UI 中设置
OPENAI_API_BASE_URL、OPENAI_API_KEY、MJ_SERVER与MJ_API_SECRET。 - 桌面/服务器二进制文件 – 从 GitHub releases 页面下载对应版本,并使用相同的环境变量运行该可执行文件。
配置 – 所有行为皆由环境变量驱动。重点项目:
OPENAI_API_*– OpenAI 端点与密钥。MJ_SERVER/MJ_API_SECRET– Midjourney 代理。SUNO_SERVER/SUNO_KEY– Suno 音乐 API。LUMA_SERVER/LUMA_KEY– Luma 视频 API。CUSTOM_MODELS– 额外模型 ID 的白名单。AUTH_SECRET_*– 简易密码保护与暴力破解限制。UPLOAD_TYPE– 选择上传文件的存储位置(R2、本地容器、自定义 URL)。
适用对象 – 想要一个单一浏览器仪表板来体验多种生成式 AI 服务,而无需切换不同前端或 API 客户端的用户。对于需要快速 UI 来测试文字、图像、音频与视频模型提示词的开发者也很有用。
授权 – MIT (参阅 license 文件)。
以上所有细节均直接取自仓库的 README;未推论任何额外功能。
相关
- 项目
- 项目
- 项目
- 项目