PozzettiAndrea/ComfyUI-DepthAnythingV3

ComfyUI support for DepthAnything V3 model

解決的問題

本專案將 Depth Anything V3 模型整合至 ComfyUI,讓使用者能從影像與影片中生成空間一致的深度圖。解決從視覺輸入中恢復視覺空間與幾何結構的問題,提供 2D 深度映射(用於 ControlNet)與 3D 重構的工具。

工作原理

提供一組用於 ComfyUI 的自訂節點,可與各種 Depth Anything V3 模型變體(從小型到巨型)介接。根據所選模型,系統可執行單目深度估計、度量深度估計,以及多視角注意力機制,以確保影片畫格間的深度一致性。同時也包含專用的正規化模式(如 V2-Style)以及將深度圖轉換為 3D 點雲或網格的工具。

適用對象

  • AI 藝術家與設計師:需要高品質深度圖用於 ControlNet 工作流程的 ComfyUI 使用者。
  • 3D 開發者:希望從單張或多張影像重建 3D 點雲或網格的使用者。
  • 影片創作者:需要在影片畫格間實現平滑且一致深度估計的使用者。

主要特色

  • 多種模型變體:支援從輕量級 DA3-Small(80M)到高保真 DA3-Nested-Giant-Large(1.4B)的廣泛模型。
  • 3D 重構:可從視覺輸入生成 3D 點雲或網格。
  • 多視角一致性:利用交叉注意力功能,維持影片畫格間的深度一致性。
  • 特殊輸出:提供天空分割遮罩,用於過濾 3D 重構中的背景雜訊。
  • 彈性正規化:提供不同正規化模式,以適應 2D 圖像生成或 3D 空間還原。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案