关于马尔可夫随机停止时间对应奖励泛函的可微性
概率论
2024-11-19 v1
摘要
我们对与马尔可夫随机停止时间相关的奖励泛函的可微性和连续性进行了研究。我们的重点主要在于可微性,这是推导奖励函数解析表达式的一种常用方法的关键要素。
关键词
引用
@article{arxiv.2411.11393,
title = {On differentiability of reward functionals corresponding to Markovian randomized stopping times},
author = {Boy Schultz},
journal= {arXiv preprint arXiv:2411.11393},
year = {2024}
}