中文

重复博弈中对混合策略的纯策略最优响应

计算机科学与博弈论 2019-02-26 v1

摘要

重复博弈难以分析,尤其是当智能体采用混合策略时。我们研究了迭代囚徒困境中的单记忆策略,然后将结果推广到重复博弈中的k记忆策略。我们的结果表明,总存在一个纯策略最优响应,可使用SMT或MDP求解器计算。然而,在多智能体锦标赛中可能不存在这样的纯策略最优响应。所有源代码均已发布以供验证。

关键词

引用

@article{arxiv.1902.09066,
  title  = {Pure Strategy Best Responses to Mixed Strategies in Repeated Games},
  author = {Shiheng Wang and Fangzhen Lin},
  journal= {arXiv preprint arXiv:1902.09066},
  year   = {2019}
}

备注

6 pages, 1 reference page. 1 figure