OpenImagingLab/AnyRecon
[SIGGRAPH Asia 2026] AnyRecon: Arbitrary-View 3D Reconstruction with Video Diffusion Model
解決的問題
AnyRecon 解決了任意視角 3D 重建的挑戰。它允許使用者從一組捕獲視角生成高品質的 3D 重建,進而能創建從任何期望相機軌跡展示場景的影片。
工作原理
該系統使用影片擴散模型(特別是 Wan2.1 I2V)結合 LoRA 權重來精煉與重建 3D 場景。它依賴點群渲染流程(π³)從捕獲視角生成條件影片。這些條件影片以及估計或自訂的相機位姿,引導影片擴散模型在不同視角下生成一致的 3D 重建。
適用對象
此專案適用於從事 3D 電腦視覺、神經渲染與生成式 AI 的研究人員與開發者,特別是那些希望將影片擴散模型整合用於 3D 場景重建的人。
主要亮點
- 任意視角重建: 生成可從任意角度觀看的 3D 場景。
- 影片擴散模型整合: 利用預訓練的 Wan2.1 I2V 模型實現高保真視覺合成。
- 自訂軌跡: 支援從測試視角影像中估計位姿,也支援手動指定相機軌跡。
- 點群引導: 使用 π³ 進行初始點群渲染,為擴散過程提供結構引導。
相關
- 專案
- 專案
- 專案
- 專案
- 專案