CUPID:基于目标和姿态联合建模的生成式 3D 重建
计算机视觉与模式识别
2025-11-25 v2
摘要
我们提出了 Cupid,这是一个联合建模完整目标分布和相机姿态的生成式 3D 重建框架。我们的两阶段基于流的模型首先生成粗糙的 3D 结构和 2D-3D 对应关系,以稳健地估计相机姿态。在该姿态条件下,细化阶段将像素对齐的图像特征直接注入生成过程,将丰富的生成模型先验与重建的几何保真性相结合。该策略实现了卓越的忠实度,超过最先进的重建方法 3 dB 以上的 PSNR 以及 10% 的 Chamfer 距离。作为一种解耦目标和相机姿态的统一生成模型,Cupid 自然扩展到多视角和场景级别的重建任务,而无需事后优化或微调。
引用
@article{arxiv.2510.20776,
title = {CUPID: Generative 3D Reconstruction via Joint Object and Pose Modeling},
author = {Binbin Huang and Haobin Duan and Yiqun Zhao and Zibo Zhao and Yi Ma and Shenghua Gao},
journal= {arXiv preprint arXiv:2510.20776},
year = {2025}
}
备注
project page at https://cupid3d.github.io