CVHub520/X-AnyLabeling

Open-source AI-assisted annotation platform for images, videos, text, and multimodal data.

What it solves

X-AnyLabeling 是一款工业级标注工具,旨在消除标记多模态数据时繁琐的手动工作。它集成 AI 引擎,为图像和视频提供快速的自动标注,大幅缩短为机器学习准备数据集的时间。

How it works

此工具提供图形用户界面 (GUI),让用户可以手动绘制多边形、矩形、立方体等形状,或使用 AI 模型自动生成标签。支持多种推理后端(ONNX Runtime、TensorRT、OpenCV DNN),也可通过 X-AnyLabeling-Server 连接远程推理服务。内置庞大的预训练模型库,涵盖目标检测、分割、OCR 等各类计算机视觉任务。

Who it’s for

此工具主要为多模态数据工程师和研究人员设计,帮助他们在计算机视觉、文档解析等领域创建高质量的标注数据集,以训练 AI 模型。

Highlights

  • Comprehensive Model Library:支持包括 YOLO 系列、SAM(Segment Anything Model)以及各种视觉语言模型(VLM)如 Qwen3-VL、Gemini 在内的广泛模型。
  • Multi-modal Support:支持图像和视频,从简单分类到复杂的 3D 立方体标注和多目标跟踪皆可处理。
  • Flexible Export Formats:支持多种行业标准格式,如 COCO、VOC、YOLO、DOTA、ShareGPT 等。
  • AI-Assisted Workflow:提供一键式推理(对任务中所有图像)、自动训练与交互式 grounding,支持开放词汇标注。