zju3dv/EfficientLoFTR
EfficientLoFTR 是一個半密集局部特徵匹配系統,提供高品質的圖像對應,且速度可與稀疏匹配方法媲美。
zju3dv/neuralbody
Neural Body 是一個研究代碼庫,透過結構化潛在編碼學習隱式神經場,從多視角影片中建模並渲染動態人體。它支援在 ZJU‑MoCap 和 People‑Snapshot 上進行訓練,並提供新視角渲染、姿勢泛化、網格提取功能,同時提供 Docker、分散式訓練及預訓練模型。
zju3dv/animatable_nerf
一個用於從影片創建逼真、可動畫化的3D人形化身的框架,使用隱式神經表示,如NeRF和SDF。
guojiajeremy/Dinomaly
一種基於 Transformer 的極簡框架,用於多類別非監督異常檢測,彌補了統一多類別模型與單類別專家模型之間的性能差距。
greyovo/PicQuery
一款使用 MobileCLIP2 實現本地照片私密、裝置內語意搜尋的 Android 應用,支援自然語言描述或影像查詢
zju3dv/Scal3R
Scal3R 是一個可擴展的 3D 重建框架,利用測試時訓練從影像集生成相機位姿、深度圖與點群。
zju3dv/Murre
一種結合 SfM 引導的單目深度估計與 TSDF 融合的多視角 3D 重建框架,可從影像中創建精確的密集 3D 模型。
google-deepmind/representations4d
Google DeepMind關於4D表示研究專案的集合,提供用於深度估計、物件追蹤等空間-時間任務的自監督影片與視覺模型。
davidpagnon/Sports2D
一種從單一影片或網路攝影機自動計算關節軌跡與角度的2D動作捕捉與生物力學分析工具。
NVlabs/AutoGaze
AutoGaze 是一種自回歸凝視模型,可為視覺變換器與多模態大模型修剪冗餘影片補丁,實現對高解析度長影片的高效處理。由 NVILabs 發布,包含訓練好的模型、訓練資料、基準測試與整合範例。