LibreYOLO/libreyolo
LibreYOLO is a MIT licensed open source computer vision library
解決的問題
LibreYOLO 提供統一且 MIT 授權的介面,支援大量電腦視覺任務。無需學習不同模型的多種 API,使用者可透過單一且一致的程式碼庫執行檢測、分割、姿態估計等任務。
工作原理
此套件將 YOLOv9、SAM、Depth Anything 等多種視覺模型封裝於單一 API 後方。使用者僅需更換模型檢查點檔案,即可輕鬆切換不同視覺任務。支援多種輸入來源,包括靜態影像、網路攝影機、RTSP 流與 YouTube URL,並提供內建工具,支援模型訓練與導出至多種部署格式。
適用對象
專為需要快速原型設計、訓練與部署多種視覺模型的電腦視覺開發者與研究人員設計,無需管理多個分散的套件。
主要特色
- 統一 API:支援 17 種不同視覺任務,包括 OCR、深度估計與背景移除,提供一致的介面。
- 廣泛模型支援:涵蓋檢測、分割、分類與 VLM(視覺語言模型)等領域的龐大模型庫。
- 彈性部署:支援導出至 12 種不同格式,包括 ONNX、TensorRT 與 CoreML,並與 NVIDIA Triton 整合。
- 完整訓練支援:內建多 GPU 訓練、LoRA、知識蒸餾功能,並與 Weights & Biases、MLflow 等主流日誌工具整合。
相關
- 專案
- 專案
- 專案
- 專案
- 專案