非齐次马尔可夫过程的长期控制
最优化与控制
2025-06-19 v1 概率论
摘要
在本文中,考虑了受控非齐次马尔可夫过程的平均奖励单位时间和平均风险敏感奖励泛函。证明了适当贝尔曼方程解的存在性。还证明了价值函数关于风险参数的连续性。最后研究了马尔可夫控制点收敛时泛函的稳定性。
引用
@article{arxiv.2506.15542,
title = {Long run control of nonhomogeneous Markov processes},
author = {Łukasz Stettner},
journal= {arXiv preprint arXiv:2506.15542},
year = {2025}
}