MCG-NJU/MOTIP

MOTIP 是一個多目標追蹤框架,它將追蹤視為上下文內 ID 預測問題,從而直接解碼當前檢測結果的 ID 標籤。

xiaobiaodu/Mobile-GS

Mobile-GS 是一個專為在移動裝置上實現高品質 3D 場景渲染而設計的即時高斯點陣框架。

allenai/olmoearth_pretrain

一系列用於地球觀測的跨模態、時空基礎模型,為利用衛星數據進行行星智能提供可擴展的框架。

Tsinghua-MARS-Lab/SLAM-Former

一種基於 Transformer 的 SLAM 系統,將定位與地圖建構整合為單一模型,用於從影像序列中實現 3D 重構與相機追蹤。

alicevision/CCTag

一個用於檢測與精確定位由同心圓組成的圓形基準標記物的電腦視覺函式庫。

81NewArk/AntiCAP-WebApi

使用模型推論解決 CAPTCHA 的 Web API 服務,支援本地與公共網路部署。

bhky/opennsfw2

一個用於檢測圖像和影片中色情內容的 Keras 實作 Yahoo Open-NSFW 模型。

RenderKit/oidn

一種基於深度學習的高性能去雜訊濾波器函式庫,透過去除蒙特卡洛雜訊,大幅縮短光線追蹤應用的渲染時間。

myBoris/wzry_ai

一個開源AI模型專案,旨在透過機器學習與自訂螢幕座標映射,實現《王者榮耀》遊戲的自動化玩法。

LuisaGroup/LuisaRender

支援 CUDA、DirectX 與 Metal 等多種硬體後端的高效能跨平台蒙特卡洛渲染器,適用於流式架構。

henrywoo/kazam

一款包含 AI 驅動 OCR 功能的 Linux 螢幕錄製與廣播工具,可從螢幕截圖中提取文字。

wenbowen123/BundleTrack

BundleTrack 是一個即時 6D 姿態追蹤框架,能在不需要物件或其類別的 3D CAD 模型的情況下,追蹤新穎物件。

OpenStitching/stitching

一個使用 OpenCV 從重疊影像創建全景圖的快速且穩健的 Python 套件。

NativeSensors/EyeGestures

一個開源眼動追蹤程式庫,可使用標準網路攝影機與手機相機,而非昂貴的專用硬體,實現眼控介面。

facebookresearch/projectaria_tools

一組用於處理與分析 Project Aria AR 眼鏡感測器與機器感知資料的 C++/Python 工具,支援 AI 與機器感知研究。

FaceAISDK/FaceAISDK_Android

適用於 Android 的離線本地人臉辨識 SDK,提供無需雲端連線的臉部偵測、辨識與活體檢測功能。

facebookresearch/Ego4d

一套針對 Ego4D 與 Ego-Exo4D 的工具箱與資料集基礎建設,提供下載、處理與訓練模型於大規模第一人稱與多視角影片資料集的工具。

yuxumin/PoinTr

PoinTr 是一個基於 Transformer 的點雲補全模型,透過幾何感知編碼器-解碼器架構,從部分點雲重建出完整的 3D 物件。

MeshInspector/MeshLib

一個跨多種程式語言的高效率 3D 網格處理 SDK,提供修復、優化與操作 3D 資料的工具。

hbb1/2d-gaussian-splatting

一種使用定向圓盤(surfels)的2D高斯濺射實現,可建立幾何精確的輻射場並生成高品質3D網格。

nipreps/fmriprep

結合先進神經影像工具,自動化運動校正、標準化與腦部提取的 fMRI 資料穩健預處理管道。

lolishinshi/imsearch

一款使用特徵點比對,透過小裁切截圖在大型資料集中尋找完整影像的工具。

cdcseacave/openMVS

OpenMVS 是一個多視角立體重建庫,可將稀疏點雲和相機姿態轉換為詳細且帶紋理的 3D 網格。

microsoft/BiomedParse

一種支援 2D 與 3D 體積推論的跨九種成像模式之生物醫學物件聯合分割、檢測與辨識基礎模型。

thiagotigaz/ocr-it

一款針對 Chrome 與 Firefox 的擴充功能,利用本機 OCR 從禁止文字選取的分頁式網頁文件與檢視器中提取文字。

ohirose/bcpd

BCPD 是一個相容 MATLAB 的命令列套件,用於點雲和函數(DET)的貝葉斯非剛性配準,具有加速的「++」模式、多種核選項,以及用於 3D 重建、形狀傳輸和空間組學資料的示範。

facebook/ThreatExchange

一組用於內容審核與安全威脅情資的工具與 API,包含用於相似性比對的影像與影片雜湊演算法。

Linfeng-Tang/Image-Fusion

涵蓋多模態、數位攝影與遙測影像融合技術的影像融合研究論文與程式碼實作的全面集合。

freesurfer/freesurfer

FreeSurfer 是一個開源軟體套件,用於處理、分析與可視化來自結構與功能研究的人類腦部 MRI 資料。

dipy/dipy

DIPY 是一個專為 MR 擴散影像分析設計的 Python 庫,為研究人員提供處理醫學影像資料的工具。

NVIDIA-AI-IOT/Lidar_AI_Solution

針對 3D Lidar 感知的極度優化 CUDA 與 TensorRT 實作集合,加速自動駕駛系統的稀疏卷積與感測器融合。

the-database/mpv-AnimeJaNai

一個定制的 mpv 影片播放器建置版本及一套 Real-ESRGAN 模型,能夠使用 TensorRT 或 DirectML 實現動漫內容的實時 4K 放大。

naver/anny

Anny 是一個基於 PyTorch 的開源可微分人體網格模型,覆蓋所有年齡段。它提供多種骨骼綁定(緊湊的 104 骨骼預設值、完整的 MakeHuman)、多種網格拓撲(包括 SMPL-X 和 SOMA),以及細粒度的形狀、局部變化和面部動作參數。透過 pip 安裝,執行簡單的 Python 範例以輸出 .ply 網格,或啟動互動式 Gradio 示範。該函式庫採用 Apache-2.0 授權,基於 MakeHuman 資產構建,旨在用於姿態估計、動畫和跨年齡身體建模等研究/生產任務。

arcships/light-ocr

適用於 Node.js 與 C++ 的快速離線 OCR 庫,支援本地影像與 PDF 的文字辨識,並具備內建硬體加速功能。

kha-white/manga-ocr

一款專為日式漫畫優化的 OCR 工具,能辨識多行文字、振假名,以及垂直與水平排版。

open-edge-platform/geti

一個用於構建電腦視覺 AI 模型的端到端平台,提供標註、訓練和優化工具,以便在邊緣硬體上進行部署。

voxelmorph/voxelmorph

一個基於學習的圖像配準庫,使用神經網絡對齊圖像並模擬變形,其特點是透過 SynthMorph 實現與對比度無關的訓練。

JEOresearch/EyeTracker

一種基於Python的輕量級3D眼動追蹤演算法,可從影片或影像資料中檢測瞳孔橢圓。

hank-ai/darknet

以 C/C++ 與 CUDA 寫成的開源神經網路框架,驅動 YOLO 即時物件偵測系統。

hku-mars/GS-SDF

一個結合了 Gaussian Splatting 與神經符號距離場 (SDF) 的 LiDAR 增強型系統,旨在實現幾何學上一致的、照片級寫實的渲染與 ................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................................thought: 3D surface reconstruction.

stereolabs/zed-sdk

一個為 ZED 相機提供的跨平台空間感知 SDK,提供即時深度感測、物件偵測與位置追蹤。

shimat/opencvsharp

OpenCV 的跨平台.NET 封裝庫,為 C# 開發者提供全面的電腦視覺與圖像處理功能。

leblancfg/autocrop

一個基於 Python 的工具,使用 YuNet 神經網路自動裁切圍繞最大偵測到的臉部的圖像,適合個人頭像與身分證照片。

imagej/ImageJ

ImageJ 是用於處理和分析科學影像的公有領域軟體,旨在透過 Java 在多個平台上運行。

kha-white/mokuro

一個對日語漫畫執行文字檢測與 OCR 的工具,可在瀏覽器中創建可選擇的文字覆疊層,便於語言學習者使用浮動詞典。

ngageoint/hootenanny

一個使用機器學習將多個地理空間資料集融合為單一無縫地圖的開源地圖資料融合工具。

facebookresearch/pytorch3d

一個基於 PyTorch 的 3D 電腦視覺研究庫,提供可微渲染以及用於操作 3D 網格與點雲的高效工具。

luxonis/depthai-core

用於與 Luxonis DepthAI 硬體介接以建構空間 AI 與電腦視覺應用的 C++ 與 Python 庫。