停止游戏的大型-小型均值场游戏:熵正则化方法
最优化与控制
2025-10-13 v2
摘要
本文研究了一种离散时间的大型-小型均值场停止游戏,其中主要玩家可以选择执行最优控制或停止时间。我们寻找作为随机化停止策略的松弛平衡,其形式为集合 valued 映射的固定点,其存在性通过直接论证方法难以证明。为克服由于主要玩家的存在所导致的困难,我们提出在主要玩家问题中引入熵正则化,同时将次要玩家的最优停止问题表述为occupation measure 上的线性规划。我们首先显示,通过 Kakutani-Fan-Glicksberg 固定点定理,正则化平衡作为某些简化集合 valued 算子的固定点存在。接下来,我们证明当正则化参数 趋于 0 时,正则化平衡收敛,极限对应于原始算子固定点的定义,从而确认原始均值场游戏问题中松弛平衡的存在。我们还将这种熵正则化方法扩展到次要玩家选择最优控制的均值场游戏问题中。
引用
@article{arxiv.2501.08770,
title = {Major-Minor Mean Field Game of Stopping: An Entropy Regularization Approach},
author = {Xiang Yu and Jiacheng Zhang and Keyu Zhang and Zhou Zhou},
journal= {arXiv preprint arXiv:2501.08770},
year = {2025}
}
备注
keywords: Major-minor mean field game of stopping, Markov decision processes, relaxed equilibrium, entropy regularization, linear programming, fixed point