gallantlab/pycortex

Pycortex 是一个用于在皮层表面可视化 fMRI 及其他体积神经影像数据的软件库。

spectralpython/spectral

一个用于处理、可视化和分类成像光谱学获取的高光谱图像数据的纯 Python 模块。

johntruckenbrodt/pyroSAR

一个用于从各种任务和软件工具中可扩展地组织和处理 SAR 卫星数据的 Python 框架。

histolab/histolab

用于处理数字病理学中全切片图像(WSIs)的工具,提供自动组织检测和深度学习管道用的信息丰富块提取。

seung-lab/connected-components-3d

专为3D多标签和灰度图像设计的高性能连通组件标记库,旨在加速生物医学成像中的实例分割分析。

cocoa-xu/evision

为 Elixir 应用程序提供 OpenCV 绑定,可自动生成计算机视觉工具,支持 CUDA 和嵌入式系统。

MRtrix3/mrtrix3

MRtrix3 是一个提供 MRI 数据处理和可视化工具的医学影像软件包。

upipes/PipeNet-Expansion

一个利用LLM生成的环境知识,将地面穿透雷达(GPR)地下诊断分类器适应到新地理区域的框架和原型系统。

jcreinhold/intensity-normalization

一个 Python 包,用于跨扫描仪和站点标准化 MR 图像强度,以防止采集伪影破坏机器学习流水线。

ngageoint/sarpy

一个支持 NGA 标准和多种商业 SLC 格式的 Python 库,用于读取、写入和处理复杂的合成孔径雷达(SAR)数据。

0x09/resdet

一个命令行工具和 C 语言库,通过频域分析来检测图像和视频的放大处理,以识别其原始来源分辨率。

pySTEPS/pysteps

一个使用光学流和随机生成器创建短期集合预测系统的 Python 库。

koide3/iridescence

专为点云算法快速原型设计而设计的轻量级 3D 可视化库,内置 UI 工具。

orfeotoolbox/OTB

一个用于处理千兆字节级光学、多光谱和雷达数据的开源库。

dkogan/mrcal

mrcal 是一个通用工具包,用于解决相机校准和结构从运动(SfM)问题,提供C和Python库以及命令行工具。

foundry/OpenCVSwiftStitch

一个使用 OpenCV 在 iOS 上将图像拼接成全景图的示例项目,展示了现代 Swift/C++ 互操作性。

scverse/squidpy

用于空间分子数据和组织显微镜图像分析与可视化的可扩展工具包。

rameau-fr/MC-Calib

支持透视和鱼眼镜头在混合配置下的通用且稳健的多相机系统校准工具箱。

AlanLuSun/High-quality-ellipse-detection

一种适用于现实世界图像的高质量椭圆检测算法,为机器人视觉和 PCB 检测等应用提供高定位精度和高效性。

hacker-frok/qq-farm-bot-ai

一款使用 OpenCV 模板匹配技术的视觉自动化机器人,用于自动化 QQ 经典农场游戏中的耕作、种子管理及社交互动。

Faceunity/FULiveDemoDroid

Faceunity 的 Face AR SDK 的 Android 集成示例,演示实时人脸追踪、美颜滤镜和 AR 效果。

Faceunity/FULiveDemo

一个演示使用 Faceunity 的 Nama SDK 实现实时人脸 AR、美化和动作追踪的 iOS 集成示例

cheind/py-motmetrics

一个使用 MOTA、MOTP、IDF1 和 HOTA 等标准指标评估多目标跟踪结果的 Python 库。

eduardolundgren/tracking.js

一个轻量级的 JavaScript 库,可直接在浏览器中实现颜色追踪和人脸检测等计算机视觉算法。

sirfz/tesserocr

一个 Tesseract OCR API 的 Python 包装器,支持并发执行和 Pillow 集成,可高效地从图像中提取文本。

3DiVi/nuitrack-sdk

一个跨平台的 3D 身体和骨骼追踪库,为多种深度传感器提供统一 API,实现以人类为中心的空间理解。

borglab/gtsfm

基于 GTSAM 和 Dask 的端到端、分布式 Structure-from-Motion 流水线,可从 2D 图像重建 3D 场景,并原生支持并行计算。

ros-perception/perception_pcl

一个将点云库(PCL)与ROS连接起来的ROS接口栈,用于3D几何处理和n-D点云处理。

aws-samples/amazon-textract-textractor

一个简化使用 Amazon Textract 从文档中提取文本、表格、表单和身份数据的 Python 包。

scverse/cellrank

一种用于单细胞数据命运映射的模块化框架,利用马尔可夫状态建模来估计细胞动态和分化概率。

luxonis/depthai-python

depthai-core C++ 库的 Python 绑定,使开发者能够使用 Python 为 Luxonis 硬件构建 AI 和计算机视觉应用。

LearnTechWithUs/Stereo-Vision

一个使用两个网络摄像头进行立体视觉校准,并利用视差图和回归算法测量物体距离的计算机视觉程序。

brainiak/brainiak

一个基于 Python 的神经科学研究分析套件,专注于功能性磁共振成像 (fMRI) 数据的处理与分析。

ashawkey/kiuikit

一个提供 3D 视觉、torch 原生网格处理以及预构建 PyTorch 神经网络模块的专用计算机视觉工具包。

ossimlabs/ossim

OSSIM 是一个开源的 C++ 地理空间图像处理库,提供正射校正、重投影和地理空间图像分析的工具。

oliverbravery/PrintGuard

一种本地视觉监控系统,实时检测3D打印失败,自动暂停打印机并提醒用户,避免浪费耗材。

MohrJonas/obsidian-ocr

一个使用本地 OCR 引擎(如 Tesseract)在 Obsidian 中实现图像和 PDF 文本搜索的插件。

cs-chan/Total-Text-Dataset

一个用于提升自然场景图像中任意形状文本检测性能的单词级英文弯曲文本数据集及评估框架。

conjuncts/gmft

gmft 是一个轻量级、高性能的PDF表格提取工具,使用Microsoft的Table Transformer将PDF表格转换为Pandas数据框等结构化格式。

FAST-Imaging/FAST

一个基于 CPU 和 GPU 的开源框架,用于高性能医疗图像处理、神经网络推理和实时可视化。

microblink/blinkid-ios

一个全面的 iOS SDK,用于安全地扫描身份文件,支持从 ID 和护照中自动提取数据,并提供可选的即用型 UI。

cmusatyalab/openface

一个使用深度神经网络从图像和实时视频流中识别人员的开源人脸识别库。

pqpo/SmartCropper

一个使用 OpenCV 和 TensorFlow 实现文档、身份证、名片等智能图像裁剪与透视校正的 Android 库。

NVlabs/nvdiffrec

一种通过联合优化从多视角图像中提取三角形3D模型、材质和光照的可微分渲染框架。

frgfm/torch-cam

一个用于可视化类激活图(CAM)的 PyTorch 库,用于解释和调试基于卷积和 Transformer 的视觉模型的预测。

ZFTurbo/Weighted-Boxes-Fusion

一个用于通过加权框融合(WBF)和NMS等方法,对多个目标检测模型的边界框预测进行集成的Python库。

yoshitomo-matsubara/torchdistill

torchdistill 是一个基于 PyTorch 的库,仅需编写 YAML 配置即可运行知识蒸馏实验(教师-学生训练)。它提供多种现代 KD 损失、用于提取中间特征的前向钩子管理器,以及视觉和 NLP 任务的示例脚本。通过 `pip install torchdistill` 安装,并在研究中使用时引用相关论文。

lucidrains/alphafold3-pytorch

一个用于预测生物分子相互作用三维结构的 PyTorch 实现,包含用于 PDB 数据集整理的全面工具。