zju3dv/EfficientLoFTR

EfficientLoFTR은 희소 매칭 방식에 필적하는 속도로 고품질 이미지 대응을 제공하는 반밀집 로컬 특징 매칭 시스템입니다.

zju3dv/neuralbody

Neural Body는 구조화된 잠재 코드를 사용하여 암시적 신경 필드를 학습하고, 다중 시점 비디오에서 동적 인체를 모델링 및 렌더링하기 위한 연구용 코드베이스입니다. ZJU‑MoCap 및 People‑Snapshot에서의 학습, 새로운 시점 렌더링, 포즈 일반화, 메시 추출을 지원하며, Docker, 분산 학습 및 사전 학습된 모델을 제공합니다.

zju3dv/animatable_nerf

NeRF 및 SDF와 같은 암시적 신경 표현을 사용하여 비디오에서 사실적이고 애니메이션 가능한 3D 인간 아바타를 생성하기 위한 프레임워크입니다.

guojiajeremy/Dinomaly

통합된 다중 클래스 모델과 단일 클래스 전문가 모델 사이의 성능 격차를 메우는 최소한의 Transformer 기반 프레임워크.

greyovo/PicQuery

MobileCLIP2를 사용하여 로컬 사진에 대해 자연어 설명 또는 이미지 쿼리를 통해 프라이버시 보장된 디바이스 내 의미 검색을 가능하게 하는 안드로이드 앱

zju3dv/Scal3R

Scal3R은 테스트 시 학습을 사용하여 이미지 세트에서 카메라 포즈, 깊이 맵, 포인트 클라우드를 생성하는 확장 가능한 3D 재구성 프레임워크입니다.

zju3dv/Murre

SfM 가이드된 단안 깊이 추정과 TSDF 융합을 결합하여 이미지에서 정확한 고밀도 3D 모델을 생성하는 다중 시점 3D 재구성 프레임워크입니다.

google-deepmind/representations4d

Google DeepMind의 4D 표현 연구 프로젝트 모음으로, 깊이 추정 및 객체 추적과 같은 공간적·시간적 작업을 위한 자기지도 동영상 및 시각 모델을 제공합니다.

davidpagnon/Sports2D

단일 비디오 또는 웹캠에서 관절 궤적과 각도를 자동으로 계산하는 2차원 모션 캡처 및 생체역학 분석 도구입니다.

NVlabs/AutoGaze

AutoGaze는 시각 변환기와 멀티모달 LLM에 대해 중복된 비디오 패치를 제거하는 자기회귀적 시선 모델로, 고해상도 장시간 비디오의 효율적인 처리를 가능하게 합니다. NVILabs에서 학습된 모델, 학습 데이터, 벤치마크, 통합 예제와 함께 공개되었습니다.