折扣强化模型中的吸收时间
概率论
2007-05-23 v1
摘要
强化 schemes 是一类非马氏随机过程。其非马氏性质使它们能够建模某种对过去的记忆。此类模型的一个子类是那些过去被指数折扣或遗忘的模型。该子类的模型通常具有以概率 1 陷入某些退化状态的性质。先前的工作集中于此类极限结果,而本文关注一种相反效应,即当折扣率 1-x 趋于 1 时,陷入陷阱的时间可能随 1/x 呈指数增长。因此,陷入陷阱的时间可能轻易超过所模拟的仿真或物理数据的生命周期。在此情形下,准平稳行为更为切题。我们将结果应用于一个基于三元(三人)交互与均匀正强化的社交网络形成模型。
引用
@article{arxiv.math/0404107,
title = {Time to absorption in discounted reinforcement models},
author = {Robin Pemantle and Brian Skyrms},
journal= {arXiv preprint arXiv:math/0404107},
year = {2007}
}
备注
12 pages