偏好变化下的社会选择:表示定理与长期策略
多智能体系统
2020-11-06 v1 人工智能
摘要
我们将具有变化偏好的群体决策研究为一个马尔可夫决策过程。我们的动机在于,为人群随时间做选择时,自动化决策系统的日益普及。我们的主要贡献是展示了如何将社会选择理论中的经典表示定理进行改造,以刻画这一动态设定下的最优策略。我们给出了与功利主义社会福祉泛函一致(与社会选择理论中的 Utilitarianism 社会福祉泛函一致)的 MDP 奖励函数的公理化刻画。我们还讨论了社会选择理论公理的实现可能未能导致长期最优结果的情况。
引用
@article{arxiv.2011.02544,
title = {Social Choice with Changing Preferences: Representation Theorems and Long-Run Policies},
author = {Kshitij Kulkarni and Sven Neth},
journal= {arXiv preprint arXiv:2011.02544},
year = {2020}
}
备注
Accepted to the Workshop on Consequential Decision Making in Dynamic Environments, NeurIPS 2020