SliceMatch:用于跨视角位姿估计的几何引导聚合方法
计算机视觉与模式识别
2023-03-30 v3
摘要
本工作解决跨视角相机位姿估计问题,即确定给定地面图像相对于局部区域航拍图像的3自由度相机位姿。我们提出SliceMatch,其由地面与航拍特征提取器、特征聚合器以及位姿预测器组成。特征提取器从地面与航拍图像中提取稠密特征。给定一组候选相机位姿,特征聚合器构建单一地面描述符与一组位姿依赖的航拍描述符。值得注意的是,我们新颖的航拍特征聚合器具有用于地面视角引导航拍特征选择的跨视角注意力模块,并利用地面相机视锥在航拍图像上的几何投影来池化特征。航拍描述符的高效构建通过使用预计算掩码实现。SliceMatch使用对比学习训练,并将位姿估计表述为地面描述符与航拍描述符之间的相似性比较。与最先进水平相比,SliceMatch在VIGOR基准上以相同的VGG16骨干在每秒150帧下取得了低19%的中位定位误差,且在使用ResNet50骨干时误差低50%。
引用
@article{arxiv.2211.14651,
title = {SliceMatch: Geometry-guided Aggregation for Cross-View Pose Estimation},
author = {Ted Lentsch and Zimin Xia and Holger Caesar and Julian F. P. Kooij},
journal= {arXiv preprint arXiv:2211.14651},
year = {2023}
}