自主水下航行器在线近似最优定点保持
系统与控制
2014-04-02 v2 机器人学
最优化与控制
摘要
本文研究了全驱动六自由度自主水下航行器最优定点保持策略的在线近似问题。所开发的控制器是二人零和博弈解的近似,其中控制器为最小化玩家,外部干扰为最大化玩家。该解利用基于强化学习的 Actor-Critic 框架进行近似。结果保证了状态的一致最终有界 (UUB) 收敛,以及近似策略无需持续激励条件即可一致最终有界 (UUB) 收敛至最优策略。
引用
@article{arxiv.1310.0063,
title = {Online Approximate Optimal Station Keeping of an Autonomous Underwater Vehicle},
author = {Patrick Walters and Warren E. Dixon},
journal= {arXiv preprint arXiv:1310.0063},
year = {2014}
}
备注
6 pages