obss/sahi
Framework agnostic sliced/tiled inference + interactive ui + error analysis plots
What it solves
SAHI 解决了在超大图像中检测小目标的难题。标准的目标检测模型往往会将高分辨率图像缩小到较小的输入尺寸,导致小目标失去关键细节。SAHI 通过实现“切片推理”来克服这一问题。
How it works
SAHI 不会把整张大图像作为单一单元处理,而是将图像切成更小且有重叠的块。每个块会独立送入检测模型。最后,SAHI 将所有块的结果合并回原始图像坐标,确保小目标以更高精度被检测,同时不失去分辨率。
Who it’s for
它面向处理高分辨率影像的开发者和研究人员,例如卫星影像、医学影像或大规模工业检测,需要在现有目标检测框架下检测小目标。
Highlights
- Framework Agnostic: 支持 Ultralytics(YOLO)、MMDetection、HuggingFace、TorchVision 与 Roboflow 等多种流行模型。
- Sliced Inference: 实现大规模图像中小目标的高精度检测。
- COCO Utilities: 包含切割 COCO 标注、将数据集转换为 YOLO 格式以及进行错误分析的工具。
- Integration: 可与 FiftyOne 集成,用于交互式可视化和预测结果检查。