gallantlab/pycortex
Pycortex 是一個用於在皮質表面可視化 fMRI 及其他體積神經影像資料的軟體程式庫。
spectralpython/spectral
一個用於處理、可視化與分類成像光譜學所獲高光譜影像資料的純 Python 模組。
johntruckenbrodt/pyroSAR
一個用於從各種任務與軟體工具中可擴展地組織與處理 SAR 衛星資料的 Python 框架。
histolab/histolab
用於處理數位病理科中全切片影像(WSIs)的工具,提供自動組織偵測與深度學習管道用的資訊豐富塊提取。
seung-lab/connected-components-3d
專為3D多標籤與灰階影像設計的高效能連通元件標記庫,旨在加速生物醫學影像中的實例分割分析。
cocoa-xu/evision
為 Elixir 應用程式提供 OpenCV 綁定,可自動產生電腦視覺工具,支援 CUDA 與嵌入式系統。
MRtrix3/mrtrix3
MRtrix3 是一個提供 MRI 資料處理與可視化工具的醫學影像軟體套件。
upipes/PipeNet-Expansion
一個利用LLM生成的環境知識,將地面穿透雷達(GPR)地下診斷分類器適應到新地理區域的框架和原型系統。
jcreinhold/intensity-normalization
一個 Python 套件,用於跨掃描儀與站點標準化 MR 影像強度,以防止擷取偽影破壞機器學習管線。
ngageoint/sarpy
一個支援 NGA 標準與多種商業 SLC 格式的 Python 套件,用於讀取、寫入與處理複雜的合成孔徑雷達(SAR)資料。
0x09/resdet
一個命令列工具與 C 語言函式庫,透過頻域分析來偵測影像與影片的放大處理,以識別其原始來源解析度。
pySTEPS/pysteps
一個使用光流與隨機生成器來建立短期集合預測系統的 Python 套件。
koide3/iridescence
專為點雲演算法快速原型設計而設計的輕量級 3D 可視化程式庫,內建 UI 工具。
orfeotoolbox/OTB
一個可處理千兆位元組級光學、多光譜與雷達資料的開源庫。
dkogan/mrcal
mrcal 是一個通用工具包,用於解決相機校準與結構從運動(SfM)問題,提供C與Python程式庫以及命令列工具。
foundry/OpenCVSwiftStitch
一個使用 OpenCV 在 iOS 上將影像拼接成全景圖的範例專案,展示現代 Swift/C++ 互操作性。
scverse/squidpy
用於空間分子數據與組織顯微鏡影像分析與可視化的可擴展工具包。
rameau-fr/MC-Calib
支援透視與魚眼鏡頭在混合配置下的通用且穩健的多相機系統校準工具箱。
AlanLuSun/High-quality-ellipse-detection
一種適用於現實世界影像的高品質橢圓檢測演算法,為機器人視覺與 PCB 檢測等應用提供高定位精確度與高效性。
hacker-frok/qq-farm-bot-ai
一款使用 OpenCV 模板比對技術的視覺自動化機器人,用於自動化 QQ 經典農場遊戲中的耕作、種子管理及社交互動。
Faceunity/FULiveDemoDroid
Faceunity 的 Face AR SDK 的 Android 集成範例,示範即時臉部追蹤、美顏濾鏡與 AR 效果。
Faceunity/FULiveDemo
一個展示使用 Faceunity 的 Nama SDK 實現即時人臉 AR、美化與動作追蹤的 iOS 整合範例
cheind/py-motmetrics
一個使用 MOTA、MOTP、IDF1 和 HOTA 等標準指標評估多目標追蹤結果的 Python 庫。
eduardolundgren/tracking.js
一個輕量級的 JavaScript 函式庫,可直接在瀏覽器中實現顏色追蹤與臉部檢測等電腦視覺演算法。
sirfz/tesserocr
一個 Tesseract OCR API 的 Python 包裝器,可支援平行執行與 Pillow 整合,有效率地從影像中提取文字。
3DiVi/nuitrack-sdk
一個跨平台的 3D 身體與骨骼追蹤庫,為多種深度感測器提供統一 API,實現以人類為中心的空間理解。
borglab/gtsfm
基於 GTSAM 與 Dask 的端對端、分散式 Structure-from-Motion 流水線,可從 2D 圖像重建 3D 場景,並原生支援平行計算。
ros-perception/perception_pcl
一個將點雲庫(PCL)與ROS連接起來的ROS介面堆疊,用於3D幾何處理與n-D點雲處理。
aws-samples/amazon-textract-textractor
一個簡化使用 Amazon Textract 從文件中提取文字、表格、表單與身分資料的 Python 套件。
scverse/cellrank
一種用於單細胞數據命運圖譜的模組化框架,利用馬爾可夫狀態建模來估計細胞動態和分化機率。
luxonis/depthai-python
depthai-core C++ 庫的 Python 繫結,讓開發者能使用 Python 為 Luxonis 硬體建構 AI 與電腦視覺應用。
LearnTechWithUs/Stereo-Vision
一個使用兩台網路攝影機進行立體視覺校準,並利用視差圖與迴歸算法測量物體距離的電腦視覺程式。
brainiak/brainiak
一個基於 Python 的神經科學研究分析套件,專注於功能性磁振造影 (fMRI) 數據的處理與分析。
ashawkey/kiuikit
一個提供 3D 視覺、torch 原生網格處理以及預建 PyTorch 神經網路模組的專業電腦視覺工具包。
ossimlabs/ossim
OSSIM 是一個開源的 C++ 地理空間影像處理函式庫,提供正射校正、重投影與地理空間影像分析的工具。
oliverbravery/PrintGuard
一種本機視覺監控系統,即時偵測3D列印失敗,自動暫停印表機並提醒使用者,避免浪費耗材。
MohrJonas/obsidian-ocr
一個使用本地 OCR 引擎(如 Tesseract)在 Obsidian 中實現圖片和 PDF 文字搜尋的插件。
cs-chan/Total-Text-Dataset
一個用於提升自然場景影像中任意形狀文字檢測性能的單詞級英文彎曲文字資料集與評估框架。
conjuncts/gmft
gmft 是一個輕量級、高效率的PDF表格提取工具,使用Microsoft的Table Transformer將PDF表格轉換為Pandas資料框等結構化格式。
FAST-Imaging/FAST
一個基於 CPU 與 GPU 的開源框架,用於高效率醫療影像處理、神經網路推論與即時可視化。
microblink/blinkid-ios
一個全面的 iOS SDK,用於安全地掃描身分文件,支援從 ID 和護照中自動提取資料,並提供可選的即用型 UI。
cmusatyalab/openface
一個使用深度神經網路從影像和即時影片串流中識別人員的開源人臉辨識程式庫。
pqpo/SmartCropper
一個使用 OpenCV 與 TensorFlow 實現文件、身分證、名片等智慧影像裁切與透視校正的 Android 套件。
NVlabs/nvdiffrec
一種透過聯合最佳化,從多角度影像中提取三角形3D模型、材質與光照的可微分渲染框架。
frgfm/torch-cam
一個用於可視化類別激活圖(CAM)的 PyTorch 庫,用於解釋與調試基於卷積與 Transformer 的視覺模型的預測。
ZFTurbo/Weighted-Boxes-Fusion
一個用於透過加權框融合(WBF)和NMS等方法,對多個物件檢測模型的邊界框預測進行整合的Python套件。
yoshitomo-matsubara/torchdistill
torchdistill 是一個基於 PyTorch 的工具庫,僅需撰寫 YAML 設定即可執行知識蒸餾實驗(教師-學生訓練)。提供多種現代 KD 損失、用於提取中間特徵的前向鈎子管理器,以及視覺與 NLP 任務的範例程式碼。透過 `pip install torchdistill` 安裝,並在研究中使用時引用相關論文。
lucidrains/alphafold3-pytorch
一個用於預測生物分子相互作用三維結構的 PyTorch 實作,並包含完整的 PDB 資料集整理工具。