基于多臂老虎机与秘书问题拓展重复消费者搜索模型
理论经济学
2020-12-24 v2
摘要
我们试图以不同的方法推导 Fishman 和 Rob (1995) 提出的重复消费者搜索模型的最优搜索策略,主要动机在于去掉每一期中价格分布 先验知识这一假设。为此,我们引入著名的多臂老虎机问题(MAB)。我们首先修改 MAB 框架以适配重复消费者搜索模型的设定,并将目标表述为一个动态优化问题。接着,给定任意探索序列,我们利用贝尔曼方程为该序列中每个商店赋予一个价值。然后,我们将问题分解为各期的独立最优停止问题,这恰好与著名的秘书问题框架一致,并由此推导最优停止策略。我们将看到,在每一期实施最优停止策略,通过「前向归纳」推理即可解决原动态优化问题。
引用
@article{arxiv.2012.11900,
title = {Expanding on Repeated Consumer Search Using Multi-Armed Bandits and Secretaries},
author = {Tung Yu Marco Chan},
journal= {arXiv preprint arXiv:2012.11900},
year = {2020}
}