LibreYOLO/libreyolo
LibreYOLO is a MIT licensed open source computer vision library
해결하는 문제
LibreYOLO는 방대한 컴퓨터 비전 작업을 위한 통합적이고 MIT 라이선스 기반의 인터페이스를 제공합니다. 다양한 모델마다 다른 API를 배워야 할 필요 없이, 하나의 일관된 코드베이스로 탐지, 세그멘테이션, 자세 추정 등을 수행할 수 있습니다.
작동 방식
이 라이브러리는 YOLOv9, SAM, Depth Anything 등의 다양한 비전 모델을 단일 API 뒤에 감싸고 있습니다. 모델 체크포인트 파일만 변경하면 다양한 비전 작업으로 쉽게 전환할 수 있습니다. 정적 이미지, 웹캠, RTSP 스트림, 유튜브 URL 등 다양한 입력 소스를 지원하며, 모델을 여러 배포 형식으로 훈련하고 내보내는 내장 도구도 제공합니다.
대상 사용자
다양한 비전 모델의 빠른 프로토타이핑, 훈련, 배포가 필요한 컴퓨터 비전 개발자 및 연구자들을 위한 도구로, 여러 개별 라이브러리를 관리할 필요 없이 사용할 수 있습니다.
주요 특징
- 통합 API: OCR, 깊이 추정, 배경 제거를 포함한 17가지의 다른 비전 작업에 대해 일관된 인터페이스 제공.
- 풍부한 모델 지원: 탐지, 세그멘테이션, 분류, VLM(비전 언어 모델) 등 다양한 분야의 방대한 모델 라이브러리 포함.
- 유연한 배포: ONNX, TensorRT, CoreML을 포함한 12가지의 다양한 형식으로 내보내기 지원 및 NVIDIA Triton 통합 가능.
- 포괄적인 훈련: 멀티 GPU 훈련, LoRA, 교사-학생 훈련, Weights & Biases 및 MLflow와 같은 인기 있는 로깅 도구 통합 기능 내장.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트