重复博弈中对混合策略的纯策略最优响应
计算机科学与博弈论
2019-02-26 v1
摘要
重复博弈难以分析,尤其是当智能体采用混合策略时。我们研究了迭代囚徒困境中的单记忆策略,然后将结果推广到重复博弈中的k记忆策略。我们的结果表明,总存在一个纯策略最优响应,可使用SMT或MDP求解器计算。然而,在多智能体锦标赛中可能不存在这样的纯策略最优响应。所有源代码均已发布以供验证。
引用
@article{arxiv.1902.09066,
title = {Pure Strategy Best Responses to Mixed Strategies in Repeated Games},
author = {Shiheng Wang and Fangzhen Lin},
journal= {arXiv preprint arXiv:1902.09066},
year = {2019}
}
备注
6 pages, 1 reference page. 1 figure