学习收取更高价格:Q-Learning 代理合谋的理论研究
综合经济学
2025-05-30 v1 人工智能
计算机科学与博弈论
经济学
摘要
越来越多的实验证据表明,-learning 代理可能会学会收取超竞争价格。我们在无限重复博弈中为这一行为提供了首个理论解释。企业仅根据观察到的利润更新其定价策略,而不计算均衡策略。我们证明,当博弈同时存在单阶段纳什均衡价格和促成合谋的价格,并且 函数在实验结束时满足某些不等式时,企业会学会持续收取超竞争价格。我们引入了一类新的单记忆子博弈完美均衡(SPE),并提供了使习得行为得到朴素合谋、冷酷触发策略或递增策略支持的条件。除非促成合谋的价格是单阶段纳什均衡,否则朴素合谋不构成 SPE,而冷酷触发策略则可以构成。
关键词
引用
@article{arxiv.2505.22909,
title = {Learning to Charge More: A Theoretical Study of Collusion by Q-Learning Agents},
author = {Cristian Chica and Yinglong Guo and Gilad Lerman},
journal= {arXiv preprint arXiv:2505.22909},
year = {2025}
}