梦想到重建:基于单图的扩散-深度蒸馏的单目三维重建
计算机视觉与模式识别
2025-08-05 v1
摘要
从单张图像进行体积场景重建对于自动驾驶和机器人等广泛应用至关重要。虽然最近的体积重建方法取得了令人印象深刻的成绩,但通常需要昂贵的3D真实标注或多视角监督。我们提出利用预训练的2D扩散模型和深度预测模型从单张图像生成合成场景几何结构,然后用于蒸馏一个前馈场景重建模型。我们在具有挑战性的KITTI-360和Waymo数据集上进行实验,证明该方法在使用多视角监督的情况下,能够匹配或超越当前最先进的基线方法,并在动态场景等方面具有独特优势。
引用
@article{arxiv.2508.02323,
title = {Dream-to-Recon: Monocular 3D Reconstruction with Diffusion-Depth Distillation from Single Images},
author = {Philipp Wulff and Felix Wimbauer and Dominik Muhle and Daniel Cremers},
journal= {arXiv preprint arXiv:2508.02323},
year = {2025}
}
备注
ICCV 2025. Website: https://philippwulff.github.io/dream-to-recon