基于外观的室内定位:块描述符性能比较
计算机视觉与模式识别
2015-07-17 v1 机器人学
摘要
视觉是最重要的感官之一,人类在导航中广泛使用它。我们评估了不同类型的图像和视频帧描述符,这些描述符可用于基于携带相机所看到的内容来确定人的独特视觉地标以进行定位。为此,我们创建了一个数据库,包含超过3公里的视频序列,以沿不同走廊行进距离为形式的基本真值。使用该数据库,可以评估定位准确性——既包括知道用户所在路线,也包括沿特定路线的位置。对于每种描述符,我们还测试了编码视觉结构和在行程间搜索以估计用户位置的不同技术。技术包括单帧描述符、使用帧序列的描述符,以及彩色和无色描述符。我们发现单帧索引在该特定数据集中表现更好。这可能是因为携带相机者的运动使视频过于依赖单个步骤和特定行程的运动。我们的结果表明基于外观的信息可能是室内导航数据的附加来源,增强例如无线电信号强度指示(RSSIs)提供的那些。此类视觉信息可通过众包低分辨率视频馈送收集,允许不同用户进行的行程相互关联,并且无需显式映射即可推断位置。这提供了基于同时定位与地图构建(SLAM)算法的补充方法。
引用
@article{arxiv.1503.03514,
title = {Appearance-based indoor localization: A comparison of patch descriptor performance},
author = {Jose Rivera-Rubio and Ioannis Alexiou and Anil A. Bharath},
journal= {arXiv preprint arXiv:1503.03514},
year = {2015}
}
备注
Accepted for publication on Pattern Recognition Letters