面向视觉 SLAM 的体素地图
机器人学
2020-03-05 v1 计算机视觉与模式识别
摘要
在现代视觉 SLAM 系统中,从重叠关键帧中检索潜在候选地图点以进行进一步特征匹配或直接跟踪是标准做法。本文中,我们认为关键帧并非此项任务的最优选择,因其存在若干固有局限,如几何推理弱与可扩展性差。我们提出一种体素地图表示,以高效检索视觉 SLAM 的地图点。具体而言,我们将地图点组织于规则体素网格中。从相机位姿可见的点通过以光线投射方式采样相机视锥来查询,借助高效体素哈希方法可在常数时间内完成。与关键帧相比,我们使用本方法检索的点在几何上保证落于相机视场内,且遮挡点可在一定程度上被识别并移除。该方法亦自然扩展至大场景与复杂多相机配置。实验结果表明,我们的体素地图表示与含 5 个关键帧的关键帧地图同样高效,并在 EuRoC 数据集上提供显著更高的定位精度(RMSE 平均提升 46%)。所提体素地图表示是视觉 SLAM 中一项基础功能的通用方法,具有广泛适用性。
引用
@article{arxiv.2003.02247,
title = {Voxel Map for Visual SLAM},
author = {Manasi Muglikar and Zichao Zhang and Davide Scaramuzza},
journal= {arXiv preprint arXiv:2003.02247},
year = {2020}
}