利用场景先验的视觉语义导航
计算机视觉与模式识别
2018-10-16 v1 人工智能
机器人学
摘要
人类如何在新颖场景中导航至目标物体?我们是否利用多年来建立的语义/功能先验来高效搜索与导航?例如,搜索杯子时我们找咖啡机旁的橱柜,搜索水果时尝试冰箱。本工作中,我们专注于将语义先验引入语义导航任务。我们提出使用图卷积网络将先验知识整合进深度强化学习框架。智能体利用知识图的特征预测动作。为评估,我们使用AI2-THOR框架。我们的实验展示了语义知识如何显著提升性能。更重要的是,我们展示了在未见场景和/或物体上的泛化改进。补充视频可通过以下链接访问:https://youtu.be/otKjuO805dE 。
引用
@article{arxiv.1810.06543,
title = {Visual Semantic Navigation using Scene Priors},
author = {Wei Yang and Xiaolong Wang and Ali Farhadi and Abhinav Gupta and Roozbeh Mottaghi},
journal= {arXiv preprint arXiv:1810.06543},
year = {2018}
}