MiaAI-Lab/Qwen3.8-27B-16gb-NVIDIA-GPUs-one-click-install

Qwen3.8-27B on 16-32 GB Nvidia GPUs one-click install for Windows / Linux

解决的问题

本项目为配备 12GB 至 32GB VRAM 的消费级 NVIDIA GPU 提供 Qwen3.8-27B 模型的「一键式」安装与服务工具包。它通过根据用户硬件自动完成环境配置、权重下载和量化选择,消除了手动操作的复杂性。

工作原理

该工具包使用 EXL3 量化(主要来自 turboderp)将大型模型适配到有限的 VRAM 中。一个启动脚本(称为 simplex)通过 nvidia-smi 分析用户的 GPU VRAM,并自动选择最适合显卡的量化级别(bpw)和上下文大小。随后,它会创建一个自包含的 Python 虚拟环境,下载所需权重,并通过 OpenAI 兼容 API 端点提供模型服务。在用户界面方面,它集成了 DeepSeek Harness(dsh),这是一个基于节点的聊天 UI,能够根据加载模型的功能自动配置自身。

适用人群

希望在 Windows 或 Linux 上无需手动管理 CUDA 工具包、编译器或复杂配置文件,即可在本地运行 Qwen3.8-27B 的 NVIDIA GPU(Turing 架构或更新)用户。

主要亮点

  • 硬件感知自动化:根据检测到的 VRAM(12GB、16GB、24GB 或 32GB+)自动选择最优模型量化和上下文窗口。
  • 自包含安装:将所有内容安装到独立文件夹(venv、models、logs)中,无需管理员权限或系统级 Python 更改。
  • OpenAI 兼容 API:提供 /v1 端点,便于与其他工具集成。
  • 可恢复下载:模型权重下载可中断并恢复,不会丢失数据。
  • 集成聊天 UI:部署 DeepSeek Harness,提供开箱即用的聊天体验,并自动配置模型参数。
  • 跨平台支持:Windows 和 Linux 均使用统一的命令行接口(simplex)。

相关

  • 项目
  • 项目
  • 项目
  • 项目