中文

学习收取更高价格:Q-Learning 代理合谋的理论研究

综合经济学 2025-05-30 v1 人工智能 计算机科学与博弈论 经济学

摘要

越来越多的实验证据表明,QQ-learning 代理可能会学会收取超竞争价格。我们在无限重复博弈中为这一行为提供了首个理论解释。企业仅根据观察到的利润更新其定价策略,而不计算均衡策略。我们证明,当博弈同时存在单阶段纳什均衡价格和促成合谋的价格,并且 QQ 函数在实验结束时满足某些不等式时,企业会学会持续收取超竞争价格。我们引入了一类新的单记忆子博弈完美均衡(SPE),并提供了使习得行为得到朴素合谋、冷酷触发策略或递增策略支持的条件。除非促成合谋的价格是单阶段纳什均衡,否则朴素合谋不构成 SPE,而冷酷触发策略则可以构成。

关键词

引用

@article{arxiv.2505.22909,
  title  = {Learning to Charge More: A Theoretical Study of Collusion by Q-Learning Agents},
  author = {Cristian Chica and Yinglong Guo and Gilad Lerman},
  journal= {arXiv preprint arXiv:2505.22909},
  year   = {2025}
}