中文

我在此处能做什么?面向认知机器人的深度功能性场景理解

机器人学 2016-02-03 v2 计算机视觉与模式识别

摘要

对于能够通过末端执行器与物理环境交互的机器人,理解周围场景并非仅仅是图像分类或物体识别的任务。为执行实际任务,机器人对视觉场景具备功能性理解至关重要。在此,我们着手解决从任意室内场景中定位与识别功能区的问题,将其构建为一个基于深度学习的两阶段检测流水线。一个新的场景功能性测试平台(由两种公开可用的室内场景数据集编译而成)被用于评估。我们的方法在新数据集上进行了定量评估,展示了从任意室内场景高效识别功能区的能力。我们还通过用来自两个不同数据集的图像进行交叉验证,证明我们的检测模型可泛化至新颖的室内场景。

关键词

引用

@article{arxiv.1602.00032,
  title  = {What Can I Do Around Here? Deep Functional Scene Understanding for Cognitive Robots},
  author = {Chengxi Ye and Yezhou Yang and Cornelia Fermuller and Yiannis Aloimonos},
  journal= {arXiv preprint arXiv:1602.00032},
  year   = {2016}
}