中文

结合绝对位姿与半广义相对位姿的视觉定位

计算机视觉与模式识别 2024-09-24 v1

摘要

视觉定位是在已知场景中估计给定查询图像相机位姿的问题。大多数最先进的定位方法遵循基于结构的范式,并使用查询图像中的像素与场景中的 3D 点之间的 2D-3D 匹配进行位姿估计。这些方法假设场景具有精确的 3D 模型,但这并不总是可用的,特别是当只有少量图像可用于计算场景表示时。相比之下,无结构方法依赖于 2D-2D 匹配,不需要任何 3D 场景模型。然而,它们的精度也低于基于结构的方法。尽管先前的一项工作提出结合基于结构和无结构的位姿估计策略,但其实际相关性尚未得到证明。我们分析了结合基于结构和无结构策略的方法,同时探索如何在分别由 2D-2D 和 2D-3D 匹配获得的位姿之间进行选择。我们表明,在多个具有实际相关性的场景中,结合这两种策略可以提高定位性能。

关键词

引用

@article{arxiv.2409.14269,
  title  = {Combining Absolute and Semi-Generalized Relative Poses for Visual Localization},
  author = {Vojtech Panek and Torsten Sattler and Zuzana Kukelova},
  journal= {arXiv preprint arXiv:2409.14269},
  year   = {2024}
}