中文

Vista3D:探索单张图像的 3D 隐藏维度

计算机视觉与模式识别 2024-09-19 v1 人工智能 计算机科学与博弈论 多媒体

摘要

我们踏上了这一古老的探索之旅:从仅凭可见部分的瞥视揭示物体的隐藏维度。为此,我们提出 Vista3D 框架,实现在仅需 5 分钟内的快速且一致的 3D 生成。在 Vista3D 核心处于两阶段方法:粗略阶段和精细阶段。在粗略阶段,我们快速从单张图像生成初始几何结构。 在精细阶段,我们直接从学习的高斯溅射中提取符号距离函数 (SDF),使用可微分等值面表示进行优化。此外,它通过两种独立的隐式函数来捕获物体的可见和遮蔽方面,提升了生成质量。此外,它通过角度溅射先验组合将 2D 溢射先验与 3D 感知溢射先验融合。通过广泛评估,我们展示,Vista3D 有效地在生成的 3D 物体的一致性和多样性之间取得平衡。演示和代码将在 https://github.com/florinshen/Vista3D 查看。

关键词

引用

@article{arxiv.2409.12193,
  title  = {Vista3D: Unravel the 3D Darkside of a Single Image},
  author = {Qiuhong Shen and Xingyi Yang and Michael Bi Mi and Xinchao Wang},
  journal= {arXiv preprint arXiv:2409.12193},
  year   = {2024}
}

备注

ECCV'2024