中文

将序贯假设检验融入对抗博弈:受孙子启发的框架

最优化与控制 2025-10-02 v2

摘要

本文研究了部分可观测博弈中序贯假设检验 (SHT) 与对抗性决策之间的相互作用,重点关注红蓝两队的欺骗策略。受《孙子兵法》及其对欺骗的强调启发,我们开发了一个新框架,既能欺骗对手又能反制其欺骗战术。我们将这种交互建模为 Stackelberg 博弈,其中蓝队作为跟随者,优化其控制以实现目标,同时误导红队对其意图形成错误信念。红队作为领导者,通过蓝队设想的 SHT 战略性地构建并灌输错误信念,以操纵蓝队的行为并暴露其真实目标。蓝队的优化问题平衡了其主要目标的实现程度与误导水平,而红队则诱导蓝队的行为符合其真实意图。我们在线性二次框架内推导出蓝队控制问题的半显式解,并说明了红队如何利用从蓝队泄露的信息来反制欺骗。数值实验验证了该模型,展示了欺骗驱动策略在对抗系统中的有效性。这些发现将古代战略智慧与现代控制和博弈论相结合,为对抗性决策领域的进一步探索(如网络安全、自主系统和金融市场)奠定了基础。

关键词

引用

@article{arxiv.2502.13462,
  title  = {Integrating Sequential Hypothesis Testing into Adversarial Games: A Sun Zi-Inspired Framework},
  author = {Haosheng Zhou and Daniel Ralston and Xu Yang and Ruimeng Hu},
  journal= {arXiv preprint arXiv:2502.13462},
  year   = {2025}
}