yuanze-lin/Olympus
一個電腦視覺的通用任務路由器,可將單一自然語言指令轉換為一系列專業模型呼叫,以產生影像、影片和3D模型。
Jumpat/SegAnyGAussians
SAGA 是一個用於分割 3D 高斯溶射場景的框架,允許使用者透過互動點提示或開放詞彙文字查詢來隔離 3D 物體。
jasmcaus/caer
Caer 是一個僅使用 Python、GPU 加速的電腦視覺函式庫,提供快速的影像/影片工具(縮放、色彩轉換、增強等),擁有乾淨且型別檢查的 API。它可以取代 OpenCV 用於研究原型,透過 `pip` 安裝,採用 MIT 授權。
Pbatch/ClashRoyaleBuildABot
一個用於皇室衝突的自動化機器人,使用先進的狀態生成器和物體偵測,用於教育和研究目的。
adipandas/multi-object-tracker
一個 Python 函式庫,提供易於使用的多目標追蹤演算法實作與基於 OpenCV 的物件偵測器,用於影片分析。
parkpow/deep-license-plate-recognition
一系列範例用戶端與操作工具,用於將 Plate Recognizer 的車牌辨識 API 整合至影像與視訊串流中。
VisualComputingInstitute/diffusion-e2e-ft
一個將影像條件擴散模型微調為單步決定性估計器的框架,實現快速且精確的深度與表面法線估計。
shoumikchow/bbox-visualizer
一個支援 VOC、COCO 與 YOLO 格式的 Python 套件,用於在影像上繪製帶標籤的邊界框,簡化物件偵測的可視化流程。
hysts/pytorch_mpiigaze_demo
一個用於注視點估計的演示程序,使用預訓練模型來追蹤人在圖像和視頻中注視的位置。
hysts/pytorch_mpiigaze
A PyTorch implementation of gaze estimation methods from the MPIIGaze and MPIIFaceGaze papers for training and evaluation of appearance-based gaze tracking.
luxonis/depthai-ros
Luxonis OAK 相機的 ROS 整合,使機器人系統能使用硬體加速的 AI 與深度感測功能。
FluxML/Metalhead.jl
Flux.jl 的標準機器學習視覺模型函式庫,提供 ResNet、ViT 和 EfficientNet 等熱門架構的實作。
Karine-Huang/T2I-CompBench
一個針對文本生成圖像模型(text-to-image generation models)的全面基準測試與評估套件,重點關注其處理複雜組合式提示詞、屬性綁定以及空間關係的能力。
frgfm/holocron
一個提供近期深度學習技巧與電腦視覺任務模型架構的高品質 PyTorch 實作函式庫。
rapidsai/cucim
cuCIM 是一個 GPU 加速的電腦視覺與影像處理函式庫,專為生醫、地理空間與遙測應用中使用的大型多維影像而設計。
theICTlab/3DUNDERWORLD-SLS-GPU_CPU
一個結構光掃描工具,能從受圖案光照射的物件影像中重建 3D 點雲,支援 CPU 與 GPU 加速。
alicevision/popsift
一個使用 CUDA 加速的 SIFT 演算法實作,可即時進行影像特徵擷取。
rgeirhos/Stylized-ImageNet
一個用於建立 Stylized-ImageNet 的工具,該版本的 ImageNet 會扭曲紋理,以鼓勵 CNN 更優先考慮物體形狀而非紋理,從而提升魯棒性。
VSLAM-LAB/VSLAM-LAB
一個全面的視覺 SLAM 框架,可簡化在多個資料集上對多種基線演算法的安裝、執行與評估流程。
l3p-cv/lost
一個彈性的、基於網頁的協作影像標註框架,支援半自動化流程以加速機器學習資料集的標記。
genicam/harvesters
一個用於簡化電腦視覺應用中影像擷取流程的 Python 函式庫,透過提供符合 GenICam 標準的裝置統一介面來實現。
basler/pypylon
Basler pylon C++ API 的官方 Python 綁定,使 Python 應用程式能夠控制 Basler 機器視覺相機並執行圖像處理任務。
cyrusbehr/YOLOv8-TensorRT-CPP
一個使用 TensorRT 的 C++ 實作 YOLOv8,以高效能 GPU 推論為目標,支援目標偵測、語意分割與姿勢估計。
jenissimo/unfake.js
一個 JavaScript 程式庫與瀏覽器工具,可清理 AI 生成的畫素藝術,並將光柵影像轉換為乾淨、可擴展的 SVG。
insight-platform/Savant
一個高階框架,用於在 Nvidia 硬體上構建即時、高效能的電腦視覺與影片分析管線,抽象化 DeepStream 的複雜性。
luispedro/mahotas
一個以 C++ 實作的快速 Python 電腦視覺函式庫,提供超過 100 種在 NumPy 陣列上運作的影像處理演算法。
opendatacam/opendatacam
一個開源的電腦視覺工具,可偵測、追蹤並計算影片串流中移動物體的數量,以量化現實世界的移動,常用於交通研究。
Visionary-Laboratory/visionary
一個基於 WebGPU 的平台,使用 ONNX Runtime 在瀏覽器中直接進行 Gaussian Splatting 變體和 3D meshes 的即時渲染。
open-edge-platform/geti_v2
Geti 是一個端到端的電腦視覺平台,可簡化從智慧數據標註與主動學習到模型訓練與邊緣部署的整個 AI 生命週期。
Koldim2001/YOLO-Patch-Based-Inference
一個 Python 函式庫,透過影像切片與結果合併,實現基於補丁的 YOLO 推論,提升在大型影像中對小物件的偵測能力。
zhiqwang/yolort
一個為 YOLOv5 設計的運行時堆疊,透過將預處理與後處理嵌入到模型圖中,簡化了各種硬體加速器的目標檢測部署。
VIAME/VIAME
VIAME 是一個開源電腦視覺工具包,透過模組化、多語言的管線框架,提供偵測、追蹤、標註、搜尋以及許多其他影像/影片處理功能。它附帶桌面版和網頁版圖形介面、命令列工具、預建二進位檔和 Docker 映像檔,並可透過 C++、Python 或 MATLAB 外掛程式擴充。
azavea/raster-vision
一個使用 PyTorch 的 Python 函式庫與低程式碼框架,用於在衛星、航空與無人機影像上建構電腦視覺模型。
opengeos/segment-geospatial
一個 Python 套件,將 Segment Anything Model (SAM) 調整為適用於地理空間資料,讓使用文字、點或框即可輕鬆分割衛星影像。
orbbec/OrbbecSDK
適用於 Orbbec 3D 相機的軟體開發工具包,讓開發者能跨多種裝置系列捕獲資料串流並控制硬體。
layumi/Person_reID_baseline_pytorch
一個輕量且強大的 PyTorch 基準,用於物件和人員重新辨識,為跨攝影機的物件檢索提供了一套全面的架構和損失函數。
google-research/augmix
AugMix 是一種數據處理技術,透過混合增強圖像並強制執行一致的嵌入,來提高圖像分類模型的魯棒性與不確定性校準。
spytensor/plants_disease_detection
一個基於 PyTorch 的影像分類流程,用於檢測作物病害,具有 ResNet50 骨幹網路和現代 PyTorch 2.x 優化。
openclimatefix/metnet
Google Research 的 MetNet 模型的 PyTorch 實作,利用衛星與大氣資料進行短期與全球降雨預測。
FORTH-ModelBasedTracker/MocapNET
即時 2D‑to‑3D 人體姿態估計器,將 RGB 影片串流轉換為標準 BVH 動作捕捉檔案,用於 3D 動畫。
andrewssobral/bgslibrary
一個全面的 C++ 框架,用於電腦視覺中的背景減除,提供超過 40 種演算法來偵測影片串流中的移動物體。
zhanghang1989/ResNeSt
一種提升電腦視覺任務(如物件檢測與語意分割)效能的 ResNet 分拆注意力網路變種。
apple-aiml-research/ml-facelit
FaceLit 是一個神經 3D 渲染專案,能夠生成在不同光照條件下可真實重照明的高品質面部影像。
MrGiovanni/SuPreM
一套用於 3D 醫療影像監督式預訓練的預訓練 3D 模型套件與 AbdomenAtlas 1.1 資料集,旨在提升器官與腫瘤分割的準確度。
MrGiovanni/ModelsGenesis
一種在無標記CT與MRI掃描上預訓練3D模型的自監督學習框架,用於建立醫學影像分割與分類的基礎模型。
geezacoleman/OpenWeedLocator
一個基於 Raspberry Pi 的開源雜草偵測系統,利用綠色偵測演算法觸發點滴噴灑,實現精準雜草控制。
rafaelpadilla/Object-Detection-Metrics
提供 PASCAL VOC 與 COCO 等流行物件檢測指標(如平均精確率與 IOU)的標準化、易用實作,確保在不同資料集間的一致性基準測試。
luxonis/depthai
depthai 庫是 Luxonis 平台的軟體框架,讓開發者能在 Luxonis 硬體上建立 AI 與電腦視覺應用程式。