stochasticai/xTuring
Build, personalize and control your own LLMs. From data pre-processing to fine-tuning, xTuring provides an easy way to personalize open-source LLMs. Join our discord community: https://discord.gg/TgHXuSJEk6
解决的问题
xTuring 提供了一种简化的方式,用于私有地微调、评估和运行开源大语言模型(LLM)。它解决了在自定义数据上训练模型时通常面临的复杂性和高昂的硬件成本问题,使用户能够在本地或私有云(VPC)中运行这些流程,以确保数据隐私。
工作原理
该项目使用高级 API 抽象了数据准备、训练和推理的复杂性。它利用 LoRA(低秩适应)和低精度量化(INT8 和 INT4)等高效技术,显著降低内存和计算需求。它还与 Intel® Extension for Transformers 集成,以优化 CPU 推理。系统基于注册表模式构建,允许用户通过统一接口创建和管理各种模型变体(例如 LLaMA、Qwen3、GPT-OSS)。
适用人群
专为需要使用自有数据个性化 LLM 但同时保持数据私密性的开发者和组织设计,也适用于希望在有限硬件(从笔记本电脑到多 GPU 配置)上运行微调或推理的用户。
主要亮点
- 广泛模型支持:支持 LLaMA 2、Qwen3、GPT-OSS、Mistral 和 Mamba 等多种模型。
- 高效训练:实现 LoRA 和 INT4/INT8 量化,显著减少 GPU 内存占用和训练时间。
- 默认私有:专为本地或 VPC 部署设计,确保数据隐私。
- 内置评估功能:包含使用困惑度等指标评估模型性能的工具。
- 交互式工具:提供 CLI 用于与模型聊天,以及基于 Gradio 的 UI 玩具箱用于测试。
- 数据集生成:提供实用工具,利用自指导和 Qwen3-Omni 等多模态检查点来构建指令语料库。
相关
- 项目
- 项目
- 项目
- 项目
- 项目