利用模拟飞行学习将自然语言指令映射到物理四旋翼控制
机器人学
2019-10-23 v1 人工智能
计算与语言
计算机视觉与模式识别
机器学习
摘要
我们提出了一种联合仿真与真实世界的学习框架,用于将导航指令和原始第一人称观测映射到连续控制。我们的模型估计环境探索的需求,预测执行过程中访问环境位置的可能性,并控制智能体既进行探索又访问高可能性位置。我们引入了监督强化异步学习(SuReAL)。学习同时使用仿真与真实环境,训练期间无需在物理环境中自主飞行,并结合用于预测待访问位置的监督学习以及用于连续控制的强化学习。我们在物理四旋翼的自然语言指令跟随任务上评估了该方法,并展示了有效的执行与探索行为。
引用
@article{arxiv.1910.09664,
title = {Learning to Map Natural Language Instructions to Physical Quadcopter Control using Simulated Flight},
author = {Valts Blukis and Yannick Terme and Eyvind Niklasson and Ross A. Knepper and Yoav Artzi},
journal= {arXiv preprint arXiv:1910.09664},
year = {2019}
}
备注
Conference on Robot Learning (CoRL) 2019