yuanze-lin/Olympus

一個電腦視覺的通用任務路由器,可將單一自然語言指令轉換為一系列專業模型呼叫,以產生影像、影片和3D模型。

Jumpat/SegAnyGAussians

SAGA 是一個用於分割 3D 高斯溶射場景的框架,允許使用者透過互動點提示或開放詞彙文字查詢來隔離 3D 物體。

jasmcaus/caer

Caer 是一個僅使用 Python、GPU 加速的電腦視覺函式庫,提供快速的影像/影片工具(縮放、色彩轉換、增強等),擁有乾淨且型別檢查的 API。它可以取代 OpenCV 用於研究原型,透過 `pip` 安裝,採用 MIT 授權。

Pbatch/ClashRoyaleBuildABot

一個用於皇室衝突的自動化機器人,使用先進的狀態生成器和物體偵測,用於教育和研究目的。

adipandas/multi-object-tracker

一個 Python 函式庫,提供易於使用的多目標追蹤演算法實作與基於 OpenCV 的物件偵測器,用於影片分析。

parkpow/deep-license-plate-recognition

一系列範例用戶端與操作工具,用於將 Plate Recognizer 的車牌辨識 API 整合至影像與視訊串流中。

VisualComputingInstitute/diffusion-e2e-ft

一個將影像條件擴散模型微調為單步決定性估計器的框架,實現快速且精確的深度與表面法線估計。

shoumikchow/bbox-visualizer

一個支援 VOC、COCO 與 YOLO 格式的 Python 套件,用於在影像上繪製帶標籤的邊界框,簡化物件偵測的可視化流程。

hysts/pytorch_mpiigaze_demo

一個用於注視點估計的演示程序,使用預訓練模型來追蹤人在圖像和視頻中注視的位置。

hysts/pytorch_mpiigaze

A PyTorch implementation of gaze estimation methods from the MPIIGaze and MPIIFaceGaze papers for training and evaluation of appearance-based gaze tracking.

luxonis/depthai-ros

Luxonis OAK 相機的 ROS 整合,使機器人系統能使用硬體加速的 AI 與深度感測功能。

FluxML/Metalhead.jl

Flux.jl 的標準機器學習視覺模型函式庫,提供 ResNet、ViT 和 EfficientNet 等熱門架構的實作。

Karine-Huang/T2I-CompBench

一個針對文本生成圖像模型(text-to-image generation models)的全面基準測試與評估套件,重點關注其處理複雜組合式提示詞、屬性綁定以及空間關係的能力。

frgfm/holocron

一個提供近期深度學習技巧與電腦視覺任務模型架構的高品質 PyTorch 實作函式庫。

rapidsai/cucim

cuCIM 是一個 GPU 加速的電腦視覺與影像處理函式庫,專為生醫、地理空間與遙測應用中使用的大型多維影像而設計。

theICTlab/3DUNDERWORLD-SLS-GPU_CPU

一個結構光掃描工具,能從受圖案光照射的物件影像中重建 3D 點雲,支援 CPU 與 GPU 加速。

alicevision/popsift

一個使用 CUDA 加速的 SIFT 演算法實作,可即時進行影像特徵擷取。

rgeirhos/Stylized-ImageNet

一個用於建立 Stylized-ImageNet 的工具,該版本的 ImageNet 會扭曲紋理,以鼓勵 CNN 更優先考慮物體形狀而非紋理,從而提升魯棒性。

VSLAM-LAB/VSLAM-LAB

一個全面的視覺 SLAM 框架,可簡化在多個資料集上對多種基線演算法的安裝、執行與評估流程。

l3p-cv/lost

一個彈性的、基於網頁的協作影像標註框架,支援半自動化流程以加速機器學習資料集的標記。

genicam/harvesters

一個用於簡化電腦視覺應用中影像擷取流程的 Python 函式庫,透過提供符合 GenICam 標準的裝置統一介面來實現。

basler/pypylon

Basler pylon C++ API 的官方 Python 綁定,使 Python 應用程式能夠控制 Basler 機器視覺相機並執行圖像處理任務。

cyrusbehr/YOLOv8-TensorRT-CPP

一個使用 TensorRT 的 C++ 實作 YOLOv8,以高效能 GPU 推論為目標,支援目標偵測、語意分割與姿勢估計。

jenissimo/unfake.js

一個 JavaScript 程式庫與瀏覽器工具,可清理 AI 生成的畫素藝術,並將光柵影像轉換為乾淨、可擴展的 SVG。

insight-platform/Savant

一個高階框架,用於在 Nvidia 硬體上構建即時、高效能的電腦視覺與影片分析管線,抽象化 DeepStream 的複雜性。

luispedro/mahotas

一個以 C++ 實作的快速 Python 電腦視覺函式庫,提供超過 100 種在 NumPy 陣列上運作的影像處理演算法。

opendatacam/opendatacam

一個開源的電腦視覺工具,可偵測、追蹤並計算影片串流中移動物體的數量,以量化現實世界的移動,常用於交通研究。

Visionary-Laboratory/visionary

一個基於 WebGPU 的平台,使用 ONNX Runtime 在瀏覽器中直接進行 Gaussian Splatting 變體和 3D meshes 的即時渲染。

open-edge-platform/geti_v2

Geti 是一個端到端的電腦視覺平台,可簡化從智慧數據標註與主動學習到模型訓練與邊緣部署的整個 AI 生命週期。

Koldim2001/YOLO-Patch-Based-Inference

一個 Python 函式庫,透過影像切片與結果合併,實現基於補丁的 YOLO 推論,提升在大型影像中對小物件的偵測能力。

zhiqwang/yolort

一個為 YOLOv5 設計的運行時堆疊,透過將預處理與後處理嵌入到模型圖中,簡化了各種硬體加速器的目標檢測部署。

VIAME/VIAME

VIAME 是一個開源電腦視覺工具包,透過模組化、多語言的管線框架,提供偵測、追蹤、標註、搜尋以及許多其他影像/影片處理功能。它附帶桌面版和網頁版圖形介面、命令列工具、預建二進位檔和 Docker 映像檔,並可透過 C++、Python 或 MATLAB 外掛程式擴充。

azavea/raster-vision

一個使用 PyTorch 的 Python 函式庫與低程式碼框架,用於在衛星、航空與無人機影像上建構電腦視覺模型。

opengeos/segment-geospatial

一個 Python 套件,將 Segment Anything Model (SAM) 調整為適用於地理空間資料,讓使用文字、點或框即可輕鬆分割衛星影像。

orbbec/OrbbecSDK

適用於 Orbbec 3D 相機的軟體開發工具包,讓開發者能跨多種裝置系列捕獲資料串流並控制硬體。

layumi/Person_reID_baseline_pytorch

一個輕量且強大的 PyTorch 基準,用於物件和人員重新辨識,為跨攝影機的物件檢索提供了一套全面的架構和損失函數。

google-research/augmix

AugMix 是一種數據處理技術,透過混合增強圖像並強制執行一致的嵌入,來提高圖像分類模型的魯棒性與不確定性校準。

spytensor/plants_disease_detection

一個基於 PyTorch 的影像分類流程,用於檢測作物病害,具有 ResNet50 骨幹網路和現代 PyTorch 2.x 優化。

openclimatefix/metnet

Google Research 的 MetNet 模型的 PyTorch 實作,利用衛星與大氣資料進行短期與全球降雨預測。

FORTH-ModelBasedTracker/MocapNET

即時 2D‑to‑3D 人體姿態估計器,將 RGB 影片串流轉換為標準 BVH 動作捕捉檔案,用於 3D 動畫。

andrewssobral/bgslibrary

一個全面的 C++ 框架,用於電腦視覺中的背景減除,提供超過 40 種演算法來偵測影片串流中的移動物體。

zhanghang1989/ResNeSt

一種提升電腦視覺任務(如物件檢測與語意分割)效能的 ResNet 分拆注意力網路變種。

apple-aiml-research/ml-facelit

FaceLit 是一個神經 3D 渲染專案,能夠生成在不同光照條件下可真實重照明的高品質面部影像。

MrGiovanni/SuPreM

一套用於 3D 醫療影像監督式預訓練的預訓練 3D 模型套件與 AbdomenAtlas 1.1 資料集,旨在提升器官與腫瘤分割的準確度。

MrGiovanni/ModelsGenesis

一種在無標記CT與MRI掃描上預訓練3D模型的自監督學習框架,用於建立醫學影像分割與分類的基礎模型。

geezacoleman/OpenWeedLocator

一個基於 Raspberry Pi 的開源雜草偵測系統,利用綠色偵測演算法觸發點滴噴灑,實現精準雜草控制。

rafaelpadilla/Object-Detection-Metrics

提供 PASCAL VOC 與 COCO 等流行物件檢測指標(如平均精確率與 IOU)的標準化、易用實作,確保在不同資料集間的一致性基準測試。

luxonis/depthai

depthai 庫是 Luxonis 平台的軟體框架,讓開發者能在 Luxonis 硬體上建立 AI 與電腦視覺應用程式。