LibreYOLO/libreyolo

LibreYOLO is a MIT licensed open source computer vision library

何を解決するか

LibreYOLOは、膨大なコンピュータビジョンタスクに対して統合的でMITライセンスのインターフェースを提供します。異なるモデルごとに異なるAPIを学ぶ必要がなく、1つの一貫したコードベースで検出、セグメンテーション、ポーズ推定などを実行できます。

仕組み

このライブラリは、YOLOv9、SAM、Depth Anythingなどの多数のビジョンモデルを1つのAPIの背後でラップしています。モデルのチェックポイントファイルを変更するだけで、異なるビジョンタスクに簡単に切り替えることができます。静止画像、Webカメラ、RTSPストリーム、YouTube URLなどのさまざまな入力ソースをサポートし、複数のデプロイフォーマットへのモデルのトレーニングとエクスポートを内蔵したツールを提供しています。

対象ユーザー

幅広いビジョンモデルの迅速なプロトタイピング、トレーニング、デプロイが必要なコンピュータビジョン開発者や研究者向けに設計されています。複数の異なるライブラリを管理する必要がありません。

主な特徴

  • 統合API: OCR、深度推定、背景除去を含む17の異なるビジョンタスクに一貫したインターフェースを提供。
  • 広範なモデルサポート: 検出、セグメンテーション、分類、VLM(ビジョン言語モデル)など、多数のモデルを含む大規模なモデルライブラリ。
  • 柔軟なデプロイ: ONNX、TensorRT、CoreMLを含む12種類のフォーマットへのエクスポートをサポートし、NVIDIA Tritonと統合可能。
  • 包括的なトレーニング: マルチGPUトレーニング、LoRA、知識蒸留、Weights & BiasesやMLflowなどの人気あるログツールとの統合を内蔵。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト