基于模仿学习的航天器交会对接专家演示方法
机器人学
2026-01-21 v1 系统与控制
系统与控制
摘要
现有航天器交会对接控制方法在很大程度上依赖于预定义的动力学模型,在真实在轨环境中往往表现出有限的鲁棒性。为解决这一问题,本文提出了一种基于模仿学习的航天器交会对接控制框架(IL-SRD),该框架直接从专家演示中学习控制策略,从而减少对精确建模的依赖。我们提出了一种锚定解码器目标机制,将解码器查询以与状态相关的锚点为条件,以显式约束控制生成过程。该机制强制执行物理一致的控制演化,并有效抑制序列预测中不合理的动作偏差,从而实现可靠的六自由度(6-DOF)交会对接控制。为进一步增强稳定性,引入了时间聚合机制,以缓解由基于 Transformer 的模型的序列预测特性引起的误差累积,其中每个时间步的微小不准确度会在长周期内传播和放大。大量仿真结果表明,所提出的 IL-SRD 框架实现了精确且节能的无模型交会对接控制。鲁棒性评估进一步证实了其在显著的未知扰动下保持优异性能的能力。源代码可在 https://github.com/Dongzhou-1996/IL-SRD 获取。
引用
@article{arxiv.2601.12952,
title = {Imitation learning-based spacecraft rendezvous and docking method with Expert Demonstration},
author = {Shibo Shao and Dong Zhou and Guanghui Sun and Liwen Zhang and Mingxuan Jiang},
journal= {arXiv preprint arXiv:2601.12952},
year = {2026}
}
备注
6 figures, 4 tables. Focus on 6-DOF spacecraft rendezvous and docking control using imitation learning-based control method