zju3dv/InfiniDepth
InfiniDepth 是一个 CVPR‑2026 项目,能将单张 RGB 图像(或 RGB 加稀疏深度图)转换为任意分辨率的深度图与 3D Gaussian‑splatting 模型。它提供开箱即用的推理脚本、Hugging Face Gradio 演示、多视角视频处理,以及用于自定义数据微调的完整训练流程。
zju3dv/EfficientLoFTR
EfficientLoFTR 是一个半密集局部特征匹配系统,提供高质量的图像对应,且速度可与稀疏匹配方法媲美。
zju3dv/neuralbody
Neural Body 是一个研究代码库,通过结构化潜在编码学习隐式神经场,从多视角视频中建模并渲染动态人体。它支持在 ZJU‑MoCap 和 People‑Snapshot 上进行训练,并提供新视角渲染、姿势泛化、网格提取功能,同时提供 Docker、分布式训练及预训练模型。
zju3dv/animatable_nerf
一个用于从视频创建逼真、可动画化的3D人形化身的框架,使用隐式神经表示,如NeRF和SDF。
guojiajeremy/Dinomaly
一种基于 Transformer 的极简框架,用于多类别无监督异常检测,弥合了统一多类别模型与单类别专家模型之间的性能差距。
greyovo/PicQuery
一款使用 MobileCLIP2 实现本地照片私密、设备内语义搜索的 Android 应用,支持自然语言描述或图像查询
zju3dv/Scal3R
Scal3R 是一个可扩展的 3D 重建框架,利用测试时训练从图像集生成相机位姿、深度图和点云。
zju3dv/Murre
一种结合 SfM 引导的单目深度估计与 TSDF 融合的多视角 3D 重建框架,可从图像中创建精确的密集 3D 模型。
google-deepmind/representations4d
Google DeepMind关于4D表示研究项目的集合,提供用于深度估计、对象跟踪等空间-时间任务的自监督视频与视觉模型。
davidpagnon/Sports2D
一种从单个视频或网络摄像头自动计算关节轨迹和角度的2D动作捕捉与生物力学分析工具。
NVlabs/AutoGaze
AutoGaze 是一种自回归凝视模型,可为视觉变换器和多模态大模型修剪冗余视频补丁,实现对高分辨率长视频的高效处理。由 NVILabs 发布,包含训练好的模型、训练数据、基准测试和集成示例。