中文

需求竞争博弈中的极大后验学习

计算机科学与博弈论 2016-12-01 v1 最优化与控制

摘要

我们考虑两家企业之间的库存竞争博弈。我们探讨的问题是:如果参与者不知道对手的行动和对手的效用函数,他们能否通过观察自身销量,在重复博弈中学会采取纳什策略?本文证明,借助极大后验估计,参与者能够学会纳什策略。同时证明,参与者的行动和信念确实会收敛到纳什均衡。

关键词

引用

@article{arxiv.1611.10270,
  title  = {Maximum a posteriori learning in demand competition games},
  author = {Mohsen Rakhshan},
  journal= {arXiv preprint arXiv:1611.10270},
  year   = {2016}
}

备注

6 pages