中文

通过欺骗学习:一种用于自主无人机导航的端到端零样本框架

机器人学 2021-11-12 v1

摘要

本文提出了一种通过杂乱环境进行自主无人机导航的新框架。控制策略在训练期间的低级环境中学习,并应用于推理时的复杂环境。在训练环境中学习的控制器被欺骗,使其相信机器人仍处于训练环境中,而实际上它正在更复杂的环境中导航。本文提出的框架可适用于在更复杂任务中复用简单策略。我们还展示了该框架可用作强化学习算法的解释工具。

关键词

引用

@article{arxiv.2111.06056,
  title  = {Learning by Cheating : An End-to-End Zero Shot Framework for Autonomous Drone Navigation},
  author = {Praveen Venkatesh and Viraj Shah and Vrutik Shah and Yash Kamble and Joycee Mekie},
  journal= {arXiv preprint arXiv:2111.06056},
  year   = {2021}
}