LibreYOLO/libreyolo
LibreYOLO is a MIT licensed open source computer vision library
何を解決するか
LibreYOLOは、膨大なコンピュータビジョンタスクに対して統合的でMITライセンスのインターフェースを提供します。異なるモデルごとに異なるAPIを学ぶ必要がなく、1つの一貫したコードベースで検出、セグメンテーション、ポーズ推定などを実行できます。
仕組み
このライブラリは、YOLOv9、SAM、Depth Anythingなどの多数のビジョンモデルを1つのAPIの背後でラップしています。モデルのチェックポイントファイルを変更するだけで、異なるビジョンタスクに簡単に切り替えることができます。静止画像、Webカメラ、RTSPストリーム、YouTube URLなどのさまざまな入力ソースをサポートし、複数のデプロイフォーマットへのモデルのトレーニングとエクスポートを内蔵したツールを提供しています。
対象ユーザー
幅広いビジョンモデルの迅速なプロトタイピング、トレーニング、デプロイが必要なコンピュータビジョン開発者や研究者向けに設計されています。複数の異なるライブラリを管理する必要がありません。
主な特徴
- 統合API: OCR、深度推定、背景除去を含む17の異なるビジョンタスクに一貫したインターフェースを提供。
- 広範なモデルサポート: 検出、セグメンテーション、分類、VLM(ビジョン言語モデル)など、多数のモデルを含む大規模なモデルライブラリ。
- 柔軟なデプロイ: ONNX、TensorRT、CoreMLを含む12種類のフォーマットへのエクスポートをサポートし、NVIDIA Tritonと統合可能。
- 包括的なトレーニング: マルチGPUトレーニング、LoRA、知識蒸留、Weights & BiasesやMLflowなどの人気あるログツールとの統合を内蔵。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト