中文

基于强化元学习的视线曲率导弹制导

机器人学 2022-05-03 v1 系统与控制 系统与控制

摘要

我们利用强化元学习优化视线曲率策略,以提升制导系统对抗机动目标的效能。该策略实现为循环神经网络,将导航系统输出映射至欧拉 321 姿态表示。随后该姿态表示用于构造方向余弦矩阵,对观测视线向量进行偏置。由偏置视线导出的视线旋转率再由制导系统映射为指令加速度。通过将偏置作为导航系统输出的函数进行变化,该策略增强了对高机动目标的精度。重要的是,我们的方法无需目标加速度估计。在实验中,我们证明当我们的方法与比例导航结合时,系统显著优于具有完美目标加速度知识的增广比例导航,在对广泛目标机动以更小控制代价实现更高精度。

关键词

引用

@article{arxiv.2205.00085,
  title  = {Line of Sight Curvature for Missile Guidance using Reinforcement Meta-Learning},
  author = {Brian Gaudet and Roberto Furfaro},
  journal= {arXiv preprint arXiv:2205.00085},
  year   = {2022}
}

备注

Submitted to 2023 Scitech Guidance and Control conference. arXiv admin note: substantial text overlap with arXiv:2109.03880; text overlap with arXiv:2004.09978