yehonathanlitman/Lift4D
[SIGGRAPH Asia 2026] Lift4D: Harmonizing Single-View 3D Estimation for 4D Reconstruction In-the-Wild
解决的问题
Lift4D 能够从单视角的「野外」视频中重建完整的 4D 资产(随时间变化的 3D 对象)。它解决了在物体可能移动或变形的视频中创建时间一致的 3D 模型的挑战,通过将多个单视角估计融合为一个统一的可变形模型。
工作原理
该流程分为三个明确的阶段:
- 分割:使用 SAM 3 基于文本提示从视频中分割出目标对象。
- Causal SAM3D:对每一帧进行 3D 重建,利用因果潜在传播来保持帧间的时间一致性。
- Lift4D 训练:将各个帧的重建结果融合为一个标准形状与学习到的变形场,生成一致的 4D 资产。
适用人群
本工具专为从事计算机视觉、4D 重建和数字资产创建的研究人员与开发者设计,适用于需要将现实世界视频片段转换为可动画 3D 模型的用户。
亮点
- 野外视频能力:支持自定义视频与文本提示进行对象分割。
- 时间一致性:采用因果潜在传播,确保 3D 重建在帧间保持稳定。
- 两步优化:将训练过程分为几何优化与外观精炼两个阶段。
- 遮挡处理:支持遮挡合成,利用场景深度信息对缺失部分进行补全。
相关
- 项目
- 项目
- 项目
- 项目
- 项目