中文

基于鲁棒在线ADP的一类分层非线性微分博弈求解

系统与控制 2019-07-29 v1 系统与控制

摘要

本文研究一类带扰动连续时间非线性系统的分层一领导者多跟随者博弈,采用一种新颖的策略迭代强化学习技术,其中博弈模型同时包含零和与非零和博弈。提出一种自适应动态规划(ADP)方法,以在最坏扰动情况下实现最优控制策略。该算法将用于估计的神经网络数量减少了约百分之三十。所提算法利用神经网络估计值函数、控制策略与扰动。利用Lyapunov理论及Nemytskii算子的性质研究了估计的收敛性。最后,仿真结果将表明所开发ADP方法的有效性。

关键词

引用

@article{arxiv.1907.11414,
  title  = {Robust On-Line ADP-based Solution of a Class of Hierarchical Nonlinear Differential Game},
  author = {Mohammad reza Satouri and Hamed Kebriaei and Abolhassan Razminia and Mohammad javad Yazdanpanah},
  journal= {arXiv preprint arXiv:1907.11414},
  year   = {2019}
}