obss/sahi

Framework agnostic sliced/tiled inference + interactive ui + error analysis plots

What it solves

SAHI 解决了在超大图像中检测小目标的难题。标准的目标检测模型往往会将高分辨率图像缩小到较小的输入尺寸,导致小目标失去关键细节。SAHI 通过实现“切片推理”来克服这一问题。

How it works

SAHI 不会把整张大图像作为单一单元处理,而是将图像切成更小且有重叠的块。每个块会独立送入检测模型。最后,SAHI 将所有块的结果合并回原始图像坐标,确保小目标以更高精度被检测,同时不失去分辨率。

Who it’s for

它面向处理高分辨率影像的开发者和研究人员,例如卫星影像、医学影像或大规模工业检测,需要在现有目标检测框架下检测小目标。

Highlights

  • Framework Agnostic: 支持 Ultralytics(YOLO)、MMDetection、HuggingFace、TorchVision 与 Roboflow 等多种流行模型。
  • Sliced Inference: 实现大规模图像中小目标的高精度检测。
  • COCO Utilities: 包含切割 COCO 标注、将数据集转换为 YOLO 格式以及进行错误分析的工具。
  • Integration: 可与 FiftyOne 集成,用于交互式可视化和预测结果检查。