中文

一种地标感知的视觉导航数据集

计算机视觉与模式识别 2025-02-25 v2

摘要

通过专家演示学习的地图表示已显示出有前景的研究价值。然而,由于缺乏能够支持高效、有监督的环境表示学习的真实世界人类导航数据集,视觉导航领域仍面临挑战。我们提出了一个地标感知的视觉导航(LAVN)数据集,以支持以人为中心的探索策略和地图构建的有监督学习。我们收集RGBD观测和人类点-点击对,作为人类标注者在虚拟和真实世界环境中以完全覆盖空间为目标进行探索的结果。人类标注者还沿着每条轨迹提供不同的地标示例,我们直觉认为这将简化地图或图构建以及定位的任务。这些人类点-点击在探索环境时作为航路点预测的直接监督。我们的数据集涵盖了广泛的场景,包括室内环境中的房间以及室外的人行道。我们在https://huggingface.co/datasets/visnavdataset/lavn (DOI: 10.57967/hf/2386)发布数据集并附有详细文档,以及长期保存计划。

关键词

引用

@article{arxiv.2402.14281,
  title  = {A Landmark-Aware Visual Navigation Dataset},
  author = {Faith Johnson and Bryan Bo Cao and Kristin Dana and Shubham Jain and Ashwin Ashok},
  journal= {arXiv preprint arXiv:2402.14281},
  year   = {2025}
}