中文

利用场景先验的视觉语义导航

计算机视觉与模式识别 2018-10-16 v1 人工智能 机器人学

摘要

人类如何在新颖场景中导航至目标物体?我们是否利用多年来建立的语义/功能先验来高效搜索与导航?例如,搜索杯子时我们找咖啡机旁的橱柜,搜索水果时尝试冰箱。本工作中,我们专注于将语义先验引入语义导航任务。我们提出使用图卷积网络将先验知识整合进深度强化学习框架。智能体利用知识图的特征预测动作。为评估,我们使用AI2-THOR框架。我们的实验展示了语义知识如何显著提升性能。更重要的是,我们展示了在未见场景和/或物体上的泛化改进。补充视频可通过以下链接访问:https://youtu.be/otKjuO805dE 。

关键词

引用

@article{arxiv.1810.06543,
  title  = {Visual Semantic Navigation using Scene Priors},
  author = {Wei Yang and Xiaolong Wang and Ali Farhadi and Abhinav Gupta and Roozbeh Mottaghi},
  journal= {arXiv preprint arXiv:1810.06543},
  year   = {2018}
}