CVHub520/X-AnyLabeling
Open-source AI-assisted annotation platform for images, videos, text, and multimodal data.
What it solves
X-AnyLabeling 是一款工業級標註工具,旨在消除標記多模態資料時繁瑣的手動工作。它整合 AI 引擎,為影像與影片提供快速的自動標記,大幅縮短為機器學習準備資料集的時間。
How it works
此工具提供圖形使用者介面 (GUI),讓使用者可以手動繪製多邊形、矩形、立方體等形狀,或使用 AI 模型自動產生標籤。支援多種推論後端(ONNX Runtime、TensorRT、OpenCV DNN),亦可透過 X-AnyLabeling-Server 連接遠端推論服務。內建龐大的預訓練模型庫,涵蓋物件偵測、分割、OCR 等各類電腦視覺任務。
Who it’s for
此工具主要為多模態資料工程師與研究人員設計,協助他們在電腦視覺、文件解析等領域建立高品質的標記資料集,以訓練 AI 模型。
Highlights
- Comprehensive Model Library:支援包括 YOLO 系列、SAM(Segment Anything Model)以及各種視覺語言模型(VLM)如 Qwen3-VL、Gemini 在內的廣泛模型。
- Multi-modal Support:支援影像與影片,從簡單分類到複雜的 3D 立方體標註與多目標追蹤皆可處理。
- Flexible Export Formats:支援多種業界標準格式,如 COCO、VOC、YOLO、DOTA、ShareGPT 等。
- AI-Assisted Workflow:提供一鍵式推論(對任務中所有影像)、自動訓練與互動式 grounding,支援開放詞彙標註。