通过欺骗学习:一种用于自主无人机导航的端到端零样本框架
机器人学
2021-11-12 v1
摘要
本文提出了一种通过杂乱环境进行自主无人机导航的新框架。控制策略在训练期间的低级环境中学习,并应用于推理时的复杂环境。在训练环境中学习的控制器被欺骗,使其相信机器人仍处于训练环境中,而实际上它正在更复杂的环境中导航。本文提出的框架可适用于在更复杂任务中复用简单策略。我们还展示了该框架可用作强化学习算法的解释工具。
引用
@article{arxiv.2111.06056,
title = {Learning by Cheating : An End-to-End Zero Shot Framework for Autonomous Drone Navigation},
author = {Praveen Venkatesh and Viraj Shah and Vrutik Shah and Yash Kamble and Joycee Mekie},
journal= {arXiv preprint arXiv:2111.06056},
year = {2021}
}