luciddreamer-cvlab/LucidDreamer
Official code for the paper "LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes".
解决的问题
LucidDreamer 能够通过单张图像和文本提示,使用高斯点阵(Gaussian Splatting)生成 3D 场景。它解决了在无需特定领域训练数据的情况下,跨多个领域创建高质量 3D 环境的挑战。
工作原理
该系统利用文本提示和输入图像引导的修复(inpainting)过程来“构想”场景。它借助 Stable Diffusion (SD 1.5) 和 ZoeDepth 等模型进行深度估计,并使用高斯点阵光栅化器将生成的视角转换为 3D 场景。用户可为生成和渲染阶段指定相机路径,以控制最终 3D 输出的视角。
适用人群
本工具专为计算机视觉和 3D 图形领域的研究人员和开发者设计,适用于希望从 2D 输入生成沉浸式 3D 场景的用户,以及使用 AI 驱动的 3D 内容创作工具的艺术家。
核心亮点
- 领域无关生成:无需特定训练即可在不同环境中生成 3D 场景。
- 灵活输入:支持单张图像与文本提示的组合输入。
- 可自定义相机路径:支持多种相机运动(如 rotate360、lookaround)用于生成和渲染。
- 与 SD 集成:支持自定义 Stable Diffusion 检查点,以获得更精细的修复结果。
相关
- 项目
- 项目
- Dispatch
- 项目
- 项目