中文

重复博弈中基于人工货币的紧迫性感知最优路由

系统与控制 2021-03-08 v2 系统与控制

摘要

当人们选择使其个人延迟最小的路径时,总体拥堵可能远高于集中式强制路由所带来的拥堵。然而,集中式路由与自利主体的存在不相容。我们如何调和二者?本文在重复博弈框架下探讨该问题,并提出一种基于人工货币的公平激励机制,该机制以系统最优的方式对自利主体进行路由,同时考虑其时间偏好。我们将该框架实例化于一个并行网络中,其中主体重复(例如每日)从共同起点节点通勤至终点节点。此后,我们聚焦于具体的双弧情形:基于一种人工货币,主体在行驶第一条较快弧时被收费,而在行驶第二条较慢弧时获得奖励。我们假设主体是理性的,并通过一个博弈对其选择建模,其中每个主体旨在最小化其当日不适(按其紧迫性加权)与该时段剩余时间(例如一周)内平均不适的组合。我们证明,若审慎选择人工货币的价格,路由模式将收敛至系统最优解,同时兼顾主体的紧迫性。我们通过数值模拟补充了研究。结果表明,与集中式最优但无紧迫性感知的策略相比,在降低主体感知不适14%至20%的同时,仍可实现系统最优解。

关键词

引用

@article{arxiv.2011.11595,
  title  = {Urgency-aware Optimal Routing in Repeated Games through Artificial Currencies},
  author = {Mauro Salazar and Dario Paccagnan and Andrea Agazzi and W. P. M. H. and Heemels},
  journal= {arXiv preprint arXiv:2011.11595},
  year   = {2021}
}

备注

Accepted for presentation at the European Control Conference 2021