多智能体均衡设计中的动态激励机制综合(完整版)
计算机科学与博弈论
2024-08-20 v1 人工智能
多智能体系统
摘要
机制设计是博弈论中一个成熟的范式,用于设计博弈以实现特定结果。本文研究了一个密切相关但又有区别的概念:均衡设计。与机制设计不同,均衡设计中设计者的权力受到更多限制;她只能修改给定博弈中的激励结构以达到预期结果,而无法从头创建博弈。我们研究使用称为回报机(reward machines)的动态激励结构进行均衡设计的问题。我们使用加权并发博弈结构作为博弈模型,目标(对于玩家和设计者)以平均收益(mean-payoff)目标的形式定义。我们展示了如何使用回报机来表示动态激励,这些激励通过分配回报来优化设计者的目标。我们在框架内提出了主要决策问题:收益改进问题。该问题本质上询问是否存在某种动态激励(由某个回报机表示),能够使设计者的收益提高超过给定阈值。我们提出了该问题的两种变体:强变体和弱变体。我们证明,这两种变体都可以通过配备图灵机在多项式时间内求解。此外,我们还证明了这些变体是 NP-hard 或 coNP-hard 的。最后,我们展示了如何在存在此类激励时构造相应的回报机。
关键词
引用
@article{arxiv.2408.10074,
title = {Synthesis of Reward Machines for Multi-Agent Equilibrium Design (Full Version)},
author = {Muhammad Najib and Giuseppe Perelli},
journal= {arXiv preprint arXiv:2408.10074},
year = {2024}
}