CVHub520/X-AnyLabeling
Open-source AI-assisted annotation platform for images, videos, text, and multimodal data.
What it solves
X-AnyLabeling은 멀티모달 데이터 라벨링에 수반되는 지루한 수작업을 없애기 위해 설계된 산업용 수준의 어노테이션 툴입니다. AI 엔진을 통합하여 이미지와 비디오에 대한 빠른 자동 라벨링을 제공함으로써 머신러닝용 데이터셋 준비 시간을 크게 단축합니다.
How it works
이 툴은 GUI를 제공하여 사용자가 폴리곤, 사각형, 큐브 등 형태를 직접 그리거나 AI 모델을 사용해 자동으로 라벨을 생성할 수 있게 합니다. ONNX Runtime, TensorRT, OpenCV DNN 등 여러 추론 백엔드를 지원하며, X-AnyLabeling-Server를 통해 원격 추론 서비스와도 연결할 수 있습니다. 객체 탐지, 세그멘테이션, OCR 등 다양한 컴퓨터 비전 작업을 위한 방대한 사전 학습 모델 라이브러리를 통합하고 있습니다.
Who it’s for
주로 멀티모달 데이터 엔지니어와 연구자를 위해 설계되었으며, 컴퓨터 비전 및 문서 파싱 등 분야에서 AI 모델을 학습시키기 위한 고품질 라벨링 데이터셋을 만들고자 하는 사람들을 대상으로 합니다.
Highlights
- Comprehensive Model Library:YOLO 시리즈, SAM(Segment Anything Model) 및 Qwen3-VL, Gemini와 같은 다양한 Vision‑Language Model(VLM)을 포함한 광범위한 모델을 지원합니다.
- Multi-modal Support:이미지와 비디오를 모두 처리하며, 간단한 분류 작업부터 복잡한 3D 큐브 어노테이션 및 다중 객체 추적까지 지원합니다.
- Flexible Export Formats:COCO, VOC, YOLO, DOTA, ShareGPT 등 업계 표준 포맷을 다양하게 내보낼 수 있습니다.
- AI-Assisted Workflow:작업 내 모든 이미지에 대한 원클릭 추론, 자동 학습, 인터랙티브 그라운딩을 통한 오픈 보카뷸러리 라벨링 기능을 제공합니다.