transformerlab/transformerlab-app
The open source research environment for AI researchers to seamlessly train, evaluate, and scale models from local hardware to GPU clusters.
What it solves
Transformer Lab 是為了統一碎片化的 AI 工具生態系而設計的。它為機器學習研究人員提供了一個單一介面,可以在本地機器、本地部署集群和雲端環境中管理 AI 模型的整個生命週期——從訓練和微調到推理和評估。
How it works
該平台作為一個控制平面,與各種推理引擎(如 vLLM, Ollama, 和 MLX)以及計算資源調度器(如 Slurm 和 SkyPilot)整合。它支持多種硬體後端,包括 Apple Silicon, NVIDIA, 和 AMD GPUs。對於個人用戶,它可以本地運行以確保隱私;對於團隊用戶,它提供集中式編排、實驗追蹤和在遠端節點上的互動式計算會話(Jupyter, VSCode)。
Who it's for
它是為機器學習研究人員、愛好者和 AI 研究實驗室打造的,這些用戶需要一種流暢的方式來協調訓練任務、管理模型註冊表,並在多種硬體上運行評估。
Highlights
- Unified AI Toolkit: LLM, Diffusion models, 和 Text-to-Speech models 的支持在一個 UI 中。
- Collaborative Orchestration: 向 Slurm 或 SkyPilot 集群提交任務,並具備從 Checkpoints 進行自動恢復功能。
- Comprehensive Training: 支持全量微調、LoRA/QLoRA, RLHF (DPO, ORPO, SIMPO), 和超參數搜索。
- Built-in Evaluation: 包含 LLM-as-a-Judge, 安全性紅隊測試,以及與 EleutherAI LM Evaluation Harness 的整合。
- Extensible Architecture: 一個 Python 插件系統和 Lab SDK 允許用戶將現有的訓練腳本與自動日誌記錄功能整合。