wkentaro/labelme

Image annotation with Python. Supports polygon, rectangle, circle, line, point, and AI-assisted annotation.

What it solves

Labelme 是一个图形化图像标注工具,旨在帮助用户为计算机视觉任务创建 ground-truth 数据。它简化了为各种 AI 模型(例如用于目标检测和分割的模型)标注图像的过程。

How it works

该工具使用 Python 编写,并使用 Qt framework 构建界面,允许用户在图像上手动绘制形状(多边形、矩形、圆形、线条和点)以定义对象。它还集成了使用 SAM (Segment Anything Model)、EfficientSAM 和 YOLO-world 的 AI 辅助功能,以实现更快的 point-to-polygon/mask 和 text-to-annotation 工作流。标注结果保存为 JSON 文件,随后可以导出为 VOC 和 COCO 等常见的数据集格式。

Who it's for

它适用于需要为图像分类、边界框检测、语义分割和实例分割创建高质量标注数据集的研究人员和开发人员。

Highlights

  • Diverse Annotation Primitives: 支持多边形、矩形、圆形、线条和点工具。
  • AI-Assisted Labeling: 集成了 SAM、EfficientSAM 和 YOLO-world,用于自动化的 mask 和基于文本的标注。
  • Multi-format Export: 将数据导出为用于语义分割和实例分割的 VOC 和 COCO 格式。
  • Video Annotation: 包括对视频帧的标注支持。
  • Global Accessibility: 提供 20 种不同语言。
  • Standalone App: 为不想管理 Python 或 Qt 依赖项的用户提供独立的可执行文件。