中文

寄存器辅助的视觉姿态识别聚合方法

计算机视觉与模式识别 2024-05-21 v1

摘要

视觉姿态识别 (VPR) 指使用计算机视觉识别当前查询图像位置的过程。由于查询图像与数据库图像之间存在显著的外观变化(如季节、光照和时间跨度),这些差异增加了姿态识别的难度。以往方法常丢弃无用特征(如天空、道路、车辆),但可能舍弃有助于提高识别精度的有用特征(如建筑物、树木)。为保留这些有用特征,我们提出了一种新的特征聚合方法。具体而言,为获得包含判别性地点信息的全局和局部特征,我们在原始图像标记上添加一些寄存器以辅助模型训练。 After 通过重新分配注意力权重,这些寄存器被丢弃。实验结果表明,这些寄存器 surprisingly 将不稳定特征从原始图像表示中分离,且优于最新方法。

关键词

引用

@article{arxiv.2405.11526,
  title  = {Register assisted aggregation for Visual Place Recognition},
  author = {Xuan Yu and Zhenyong Fu},
  journal= {arXiv preprint arXiv:2405.11526},
  year   = {2024}
}