中文

多视图图像基准定位

计算机视觉与模式识别 2025-04-01 v1

摘要

图像检索(IR)方法的图像定位相对于3D方法和深度学习(DNN)方法具有显著优势:它与观察无关、更易于实现和使用、没有隐私问题,并且计算效率高。其主要缺点是相对于竞争方法,在查询相机的位置和姿态上定位相对较差。本文提出了一种混合方法,仅存储图像特征(如某些IR方法),但依赖于隐式3D重建(如3D方法),而不保留3D场景重建。该方法基于两个想法:(i)一种新颖的方案,其中查询相机中心估计仅依赖于相对平移估计,而不依赖于相对旋转估计,通过对这两种量进行解耦;(ii)从计算最优姿态从估计的相对姿态转变为从多视图对应关系中计算最优姿态,从而省去“中间人”。我们的方法在7-Scenes和Cambridge Landmarks数据集上显示出 improved performance,同时在时间和内存占用方面优于当前最先进的方法。

关键词

引用

@article{arxiv.2503.23577,
  title  = {Multiview Image-Based Localization},
  author = {Cameron Fiore and Hongyi Fan and Benjamin Kimia},
  journal= {arXiv preprint arXiv:2503.23577},
  year   = {2025}
}