Quad2Plane:一种基于滚动时域控制的空中机器人在线探索中间训练流程
机器人学
2022-03-22 v1
摘要
数据驱动的机器人技术依赖于准确的真实世界表示以学习有用的策略。尽管我们尽了最大努力,零样本仿真到实物的迁移仍是一个未解决的问题,且我们经常需要让智能体进行在线探索以为给定任务学习有用策略。对于野外机器人的许多应用而言,在线探索成本高昂且危险,在固定翼空中机器人中尤为如此。为应对这些挑战,我们提供一种用于野外机器人学习的中间方案。我们研究使用异构平台载具进行学习,并给出一种以一载具模仿另一载具行为的流程。我们具体考虑使用多旋翼宿主平台来训练固定翼飞行器这一昂贵且危险的载具类型的问题。利用模型预测控制方法,我们设计了一个能够在仿真与真实世界中模仿其他载具行为的控制器。
引用
@article{arxiv.2203.10910,
title = {Quad2Plane: An Intermediate Training Procedure for Online Exploration in Aerial Robotics via Receding Horizon Control},
author = {Alexander Quessy and Thomas Richardson},
journal= {arXiv preprint arXiv:2203.10910},
year = {2022}
}
备注
Preprint