cvat-ai/cvat
Computer Vision Annotation Tool (CVAT) is a leading platform for building high-quality visual datasets for vision AI. It offers open-source, cloud, and enterprise products, as well as labeling services, for image, video, and 3D annotation with AI-assisted labeling, quality assurance, team collaboration, analytics, and developer APIs.
What it solves
CVAT 是一個數據標註平台,旨在幫助團隊為電腦視覺和視覺 AI 構建高品質的視覺數據集。它通過提供一個中心化的數據集管理和協作環境,消除了標記圖像、影片和 3D 點雲的繁瑣手動工作。
How it works
用戶將視覺數據上傳到自託管的服務器(通過 Docker 部署),並使用基於 Web 的界面來應用標籤,例如邊界框(bounding boxes)、多邊形(polygons)和掩碼(masks)。該平台支持手動標註和 AI 驅動的自動標註,通過連接外部 ML 模型(通過 Nuclio)來執行檢測、分割和跟踪任務。它還提供 Python SDK、CLI 和 REST API,用於自動化數據流水線。
Who it’s for
它是為研究和生產 AI 團隊而設計的,這些團隊需要在保持對數據基礎設施的完全控制權的同時,創建和管理大規模的視覺數據集。
Highlights
- Multi-modal Annotation: 支持圖像、影片和 3D 點雲。
- AI-Assisted Labeling: 集成與 SAM, YOLO, 和 Mask RCNN 等模型,以加速標註過程。
- Enterprise-Grade Collaboration: 包括多用戶支持、基於角色的權限控制、任務分配和審核工作流。
- Extensive Format Support: 支持導入和導出超過 20 種行業標準格式,包括 COCO, YOLO, 和 Pascal VOC。
- Cloud Integration: 連接直接到雲端存儲提供商,如 AWS S3, Azure, 和 Google Cloud。"},