wkentaro/labelme
Image annotation with Python. Supports polygon, rectangle, circle, line, point, and AI-assisted annotation.
What it solves
Labelme 是一个图形化图像标注工具,旨在帮助用户为计算机视觉任务创建 ground-truth 数据。它简化了为各种 AI 模型(例如用于目标检测和分割的模型)标注图像的过程。
How it works
该工具使用 Python 编写,并使用 Qt framework 构建界面,允许用户在图像上手动绘制形状(多边形、矩形、圆形、线条和点)以定义对象。它还集成了使用 SAM (Segment Anything Model)、EfficientSAM 和 YOLO-world 的 AI 辅助功能,以实现更快的 point-to-polygon/mask 和 text-to-annotation 工作流。标注结果保存为 JSON 文件,随后可以导出为 VOC 和 COCO 等常见的数据集格式。
Who it's for
它适用于需要为图像分类、边界框检测、语义分割和实例分割创建高质量标注数据集的研究人员和开发人员。
Highlights
- Diverse Annotation Primitives: 支持多边形、矩形、圆形、线条和点工具。
- AI-Assisted Labeling: 集成了 SAM、EfficientSAM 和 YOLO-world,用于自动化的 mask 和基于文本的标注。
- Multi-format Export: 将数据导出为用于语义分割和实例分割的 VOC 和 COCO 格式。
- Video Annotation: 包括对视频帧的标注支持。
- Global Accessibility: 提供 20 种不同语言。
- Standalone App: 为不想管理 Python 或 Qt 依赖项的用户提供独立的可执行文件。