cvat-ai/cvat
Computer Vision Annotation Tool (CVAT) is a leading platform for building high-quality visual datasets for vision AI. It offers open-source, cloud, and enterprise products, as well as labeling services, for image, video, and 3D annotation with AI-assisted labeling, quality assurance, team collaboration, analytics, and developer APIs.
What it solves
CVAT 是一个数据标注平台,旨在帮助团队为计算机视觉和视觉 AI 构建高质量的视觉数据集。它通过提供一个中心化的数据集管理和协作协作环境,消除了标记图像、视频和 3D 点云的手动工作。
How it works
用户将视觉数据上传到自托管的服务器(通过 Docker 部署)并使用基于 Web 的界面来应用标签,例如 bounding boxes, polygons, 和 masks。该平台支持手动标注和 AI 驱动的自动标注,通过连接外部 ML 模型(通过 Nuclio)来执行检测、分割和跟踪任务。它还提供 Python SDK, CLI, 和 REST API 用于自动化数据流水线。
Who it’s for
它是为研究和生产 AI 团队而设计的,这些团队需要在保持对数据基础设施的完全控制权的同时,创建和管理大规模的视觉数据集。
Highlights
- Multi-modal Annotation: 支持图像、视频和 3D 点云。
- AI-Assisted Labeling: 集成与 SAM, YOLO, 和 Mask RCNN 等模型,以加速标注过程。
- Enterprise-Grade Collaboration: 包括多用户支持、基于角色的访问控制、任务分配和审核工作流。
- Extensive Format Support: 支持导入和导出超过 20 种行业标准格式,包括 COCO, YOLO, 和 Pascal VOC。
- Cloud Integration: 直接连接到云存储提供商,如 AWS S3, Azure, 和 Google Cloud。"},