瓷器店中的机器人:利用强化学习实现位置特定导航行为
机器人学
2021-06-04 v1 机器学习
摘要
机器人需要能够在多种不同环境中工作。即使在执行相似任务时,也应部署不同的行为以最好地适应当前环境。在本文中,我们提出一种新的导航方法,将其视为多任务学习问题。这使得机器人能够学会在不同环境的视觉导航任务中表现不同,同时跨环境学习共享的专业知识。我们在模拟环境以及真实世界数据上评估了我们的方法。我们的方法使系统收敛所需的训练时间减少 26%,同时提高了准确率。
引用
@article{arxiv.2106.01434,
title = {Robot in a China Shop: Using Reinforcement Learning for Location-Specific Navigation Behaviour},
author = {Xihan Bian and Oscar Mendez and Simon Hadfield},
journal= {arXiv preprint arXiv:2106.01434},
year = {2021}
}
备注
Published at ICRA 2021