Stackelberg-Pareto 合成(扩展版)
计算机科学与博弈论
2022-03-03 v1
摘要
我们研究图上双人 Stackelberg 博弈的框架,其中玩家 0 宣布一个策略,玩家 1 以最优响应的策略理性回应。虽然通常假设玩家 1 只有一个目标,我们在此考虑其具有多个目标的新设定。在此背景下,玩家 1 以策略回应后,获得一个由其满足的目标对应的布尔向量形式的收益。玩家 1 的理性体现为:给定玩家 0 的策略,其回应必须产生 Pareto 最优收益。我们针对若干类 -正则目标研究 Stackelberg-Pareto 合成问题,即询问玩家 0 是否能宣布一个策略,使其目标在玩家 1 的任何理性回应下均满足。我们证明,当目标均为可达性、安全性、Büchi、co-Büchi、布尔 Büchi、奇偶、Muller、Streett 或 Rabin 目标时,该问题是固定参数可处理的。我们还证明,除 Büchi 目标为 NP 完全、co-Büchi 目标属于 NEXPTIME 且 NP 困难外,该问题为 NEXPTIME 完全。在可达性目标且图为树这一简单情形下,该问题已是 NP 完全的。
引用
@article{arxiv.2203.01285,
title = {Stackelberg-Pareto Synthesis (Extended Version)},
author = {Véronique Bruyère and Baptiste Fievet and Jean-François Raskin and Clément Tamines},
journal= {arXiv preprint arXiv:2203.01285},
year = {2022}
}
备注
47 pages, 9 figures. arXiv admin note: substantial text overlap with arXiv:2102.08925