通过深度强化学习迈向基于单目视觉的避障
机器人学
2017-06-30 v1
摘要
避障是自主机器人在真实世界中运行并交互的基本需求。当感知仅限于单目视觉时,由于缺少3D信息,避免碰撞变得极具挑战。传统的避障路径规划器需要调参且无法直接受益于大数据集与持续使用。本文提出一种基于竞争架构的深度双Q网络(D3QN)用于避障,仅使用单目RGB视觉。基于竞争与双Q机制,D3QN能高效学习如何在模拟器中避障,即使从RGB图像预测的深层信息带有强噪声。大量实验表明,D3QN相比普通深度Q网络实现两倍学习加速,且仅在虚拟环境中训练的模型可直接迁移至真实机器人,对包含未见动态物体的多种新环境泛化良好。
引用
@article{arxiv.1706.09829,
title = {Towards Monocular Vision based Obstacle Avoidance through Deep Reinforcement Learning},
author = {Linhai Xie and Sen Wang and Andrew Markham and Niki Trigoni},
journal= {arXiv preprint arXiv:1706.09829},
year = {2017}
}
备注
Accepted by RSS 2017 workshop New Frontiers for Deep Learning in Robotics