unslothai/unsloth-zoo
Utils for Unsloth https://github.com/unslothai/unsloth
해결하는 문제
Unsloth Zoo는 대규모 언어 모델(LLM)의 파인튜닝을 훨씬 더 빠르고 메모리 효율적으로 만드는 유틸리티를 제공합니다. Llama, Mistral, Qwen과 같은 최첨단 모델의 파인튜닝 시 일반적으로 발생하는 높은 VRAM 요구량과 느린 학습 속도 문제를 해결합니다.
작동 방식
이 프로젝트는 OpenAI의 Triton 언어로 작성된 커스텀 커널과 수동 백프로파게이션 엔진을 사용하여 학습을 최적화합니다. 정확도를 희생하지 않고 전체 파인튜닝, 4비트, 8비트, 16비트 학습 모드를 모두 지원합니다. NVIDIA GPU(2018년 이후)에서 작동하도록 설계되었으며, Hugging Face의 TRL 및 Trainer 라이브러리와 통합됩니다.
대상 사용자
제한된 하드웨어(예: 소비자용 GPU)에서 LLM, 비전 모델, 또는 텍스트-음성(TTS) 모델을 파인튜닝하고 싶은 개발자나 AI 연구자, 또는 학습 파이프라인을 가속화하고 싶은 사용자에게 적합합니다.
주요 특징
- 매우 뛰어난 성능 향상: 최대 2.2배 빠른 학습과 최대 80%의 VRAM 사용량 감소.
- 광범위한 모델 호환성: Llama 3.1/3.2/4, Mistral, Qwen3, Gemma 3, Phi-4 등과 함께 비전 및 TTS 모델도 지원.
- 정확도 손실 없음: 근사 방법이 아닌 정확한 계산을 사용.
- 유연한 내보내기: 파인튜닝된 모델을 GGUF, Ollama, vLLM, Hugging Face 형식으로 내보낼 수 있습니다.
- 고급 RL 지원: 메모리 효율적인 강화학습(RL) 및 GRPO를 포함하여 추론 모델 학습을 지원.
관련
- Dispatch
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트