基于强化元学习的视线曲率导弹制导
机器人学
2022-05-03 v1 系统与控制
系统与控制
摘要
我们利用强化元学习优化视线曲率策略,以提升制导系统对抗机动目标的效能。该策略实现为循环神经网络,将导航系统输出映射至欧拉 321 姿态表示。随后该姿态表示用于构造方向余弦矩阵,对观测视线向量进行偏置。由偏置视线导出的视线旋转率再由制导系统映射为指令加速度。通过将偏置作为导航系统输出的函数进行变化,该策略增强了对高机动目标的精度。重要的是,我们的方法无需目标加速度估计。在实验中,我们证明当我们的方法与比例导航结合时,系统显著优于具有完美目标加速度知识的增广比例导航,在对广泛目标机动以更小控制代价实现更高精度。
引用
@article{arxiv.2205.00085,
title = {Line of Sight Curvature for Missile Guidance using Reinforcement Meta-Learning},
author = {Brian Gaudet and Roberto Furfaro},
journal= {arXiv preprint arXiv:2205.00085},
year = {2022}
}
备注
Submitted to 2023 Scitech Guidance and Control conference. arXiv admin note: substantial text overlap with arXiv:2109.03880; text overlap with arXiv:2004.09978