facebookresearch/mvdust3r

Open source impl of **MV-DUSt3R+ Single-Stage Scene Reconstruction from Sparse Views In 2 Seconds** from Meta Reality Labs. Project page https://mv-dust3rp.github.io/

解決的問題

MV-DUSt3R+ 能夠從少量 RGB 圖像(稀疏視圖)中實現快速的單階段 3D 場景重建。它消除了對預計算相機姿態的需求,允許系統在不知道相機確切位置的情況下從圖像或影片中重建場景。

工作原理

該專案是 DUSt3R 模型的微調版本。它透過處理多個 RGB 圖像或影片幀,在單個步驟中預測 3D 點雲與相機姿態。它可以處理可變數量的視圖(範圍為 4 到 12 個),並提供信心門檻值以過濾重建中的低品質點。

適用對象

電腦視覺、3D 重建與空間 AI 領域的研究人員與開發人員,特別是那些正在尋找無需將顯式相機標定或姿態估計作為獨立步驟的高速重建流水線的人員。

亮點

  • 無需姿態的重建:僅透過 RGB 圖像即可重建 3D 場景,無需相機姿態。
  • 單階段流程:在單個步驟中執行重建,而非多階段流水線。
  • 極速性能:能夠在約 2 秒內重建場景。
  • 多功能輸入:同時支援多張靜態圖像與影片檔案。
  • 附加功能:支援相對姿態估計與新視圖合成。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案