中文

CUPID:基于目标和姿态联合建模的生成式 3D 重建

计算机视觉与模式识别 2025-11-25 v2

摘要

我们提出了 Cupid,这是一个联合建模完整目标分布和相机姿态的生成式 3D 重建框架。我们的两阶段基于流的模型首先生成粗糙的 3D 结构和 2D-3D 对应关系,以稳健地估计相机姿态。在该姿态条件下,细化阶段将像素对齐的图像特征直接注入生成过程,将丰富的生成模型先验与重建的几何保真性相结合。该策略实现了卓越的忠实度,超过最先进的重建方法 3 dB 以上的 PSNR 以及 10% 的 Chamfer 距离。作为一种解耦目标和相机姿态的统一生成模型,Cupid 自然扩展到多视角和场景级别的重建任务,而无需事后优化或微调。

关键词

引用

@article{arxiv.2510.20776,
  title  = {CUPID: Generative 3D Reconstruction via Joint Object and Pose Modeling},
  author = {Binbin Huang and Haobin Duan and Yiqun Zhao and Zibo Zhao and Yi Ma and Shenghua Gao},
  journal= {arXiv preprint arXiv:2510.20776},
  year   = {2025}
}

备注

project page at https://cupid3d.github.io