需求竞争博弈中的极大后验学习
计算机科学与博弈论
2016-12-01 v1 最优化与控制
摘要
我们考虑两家企业之间的库存竞争博弈。我们探讨的问题是:如果参与者不知道对手的行动和对手的效用函数,他们能否通过观察自身销量,在重复博弈中学会采取纳什策略?本文证明,借助极大后验估计,参与者能够学会纳什策略。同时证明,参与者的行动和信念确实会收敛到纳什均衡。
引用
@article{arxiv.1611.10270,
title = {Maximum a posteriori learning in demand competition games},
author = {Mohsen Rakhshan},
journal= {arXiv preprint arXiv:1611.10270},
year = {2016}
}
备注
6 pages