Lightning-AI/litgpt

20+ high-performance LLMs with recipes to pretrain, finetune and deploy at scale.

解决的问题

LitGPT 提供了一个高性能、轻量级的框架,用于处理超过 20 种流行的大型语言模型(LLMs)。它消除了复杂的抽象层,使开发者能够完全控制模型实现,从而在企业级规模下最大化性能、降低成本并简化调试。

工作原理

每个支持的 LLM 都在单个文件中从头实现,以消除内部抽象。该项目提供统一的命令行接口(CLI)和 Python API,用于管理 LLM 的整个生命周期:预训练、持续预训练、微调、评估和部署。它利用 Flash Attention、FSDP 和量化(fp4/8/16/32)等高级优化技术,减少 GPU 内存使用,并可从 1 到 1,000+ GPU/TPU 扩展。

适用人群

专为需要高性能、透明化 LLM 框架的开发者和企业团队设计,支持多种模型(如 Llama 3、Gemma 2、Phi 4 和 Qwen 2.5),并要求对训练和推理过程有精确控制。

主要亮点

  • 广泛的模型支持:支持 20+ 种高性能 LLM,包括 Llama、Gemma、Phi 和 Qwen。
  • 无抽象层:单文件实现,便于调试且性能最大化。
  • 全生命周期管理:集成工具支持预训练、微调(LoRA、QLoRA、Adapter)和部署。
  • 企业级扩展:支持 FSDP 和大规模 GPU/TPU 集群,优化可扩展性。
  • 快速部署:内置 serve 命令,可快速将模型转换为推理 API。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目