opendatalab/labelU

Open-source multimodal data annotation platform with AI auto-annotation support.

解决的问题

LabelU 通过提供统一的多模态数据标注平台,解决了为 AI 模型准备高质量训练数据的难题。它简化了图像、视频和音频文件的标注流程,这些任务传统上是繁琐且需要大量人工操作的。

工作原理

LabelU 提供一系列可视化标注工具,用户可通过简单配置标记数据。支持多种模态:

  • 图像:支持 2D 边界框、语义分割、多段线和关键点标注工具。
  • 视频:支持分割、分类和信息提取功能。
  • 音频:通过声音可视化支持分割、分类和信息提取工具。

为加速流程,平台集成了 AI 辅助标注功能,支持加载预标注数据,或通过模型服务器(如 Florence-2、GroundingDINO + SAM 或 SAM 3)使用「AI 自动标注」功能,自动检测和分割对象。

适用人群

专为需要创建标注数据集以训练机器学习模型的开发者和数据科学家设计,适用于目标检测、场景分析、动作识别和音频分析等领域。

核心亮点

  • 多模态支持:在一个平台上处理图像、视频和音频数据。
  • AI 驱动自动化:内置对先进模型(如 SAM 3)的自动标注支持。
  • 灵活导出:支持导出为 JSON、COCO 和 MASK 等常见格式。
  • 云集成:支持直接从 S3 兼容对象存储(如 AWS S3、MinIO)导入数据。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目