PozzettiAndrea/ComfyUI-DepthAnythingV3

ComfyUI support for DepthAnything V3 model

解决的问题

该项目将 Depth Anything V3 模型集成到 ComfyUI 中,使用户能够从图像和视频中生成空间一致的深度图。它解决了从视觉输入中恢复视觉空间和几何结构的问题,为 2D 深度映射(用于 ControlNet)和 3D 重建提供了工具。

工作原理

提供一组用于 ComfyUI 的自定义节点,可与各种 Depth Anything V3 模型变体(从小型到巨型)进行交互。根据所选模型,系统可执行单目深度估计、度量深度估计以及多视角注意力机制,以确保视频帧之间的深度一致性。还包含专门的归一化模式(如 V2-Style)以及将深度图转换为 3D 点云或网格的工具。

适用人群

  • AI 艺术家和设计师:需要高质量深度图用于 ControlNet 工作流的 ComfyUI 用户。
  • 3D 开发者:希望从单张或多张图像中重建 3D 点云或网格的用户。
  • 视频创作者:需要在视频帧之间实现平滑且一致的深度估计的用户。

主要亮点

  • 多种模型变体:支持从轻量级 DA3-Small(80M)到高保真 DA3-Nested-Giant-Large(1.4B)的广泛模型。
  • 3D 重建:能够从视觉输入生成 3D 点云或网格。
  • 多视角一致性:利用交叉注意力功能,保持视频帧之间的深度一致性。
  • 特殊输出:提供天空分割掩码,用于过滤 3D 重建中的背景噪声。
  • 灵活的归一化:提供不同的归一化模式,以适应 2D 图像生成或 3D 空间恢复。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目