入侵容错问题的马尔可夫决策过程模型
系统与控制
2025-09-10 v1 系统与控制
摘要
我们对最简单的马尔可夫决策过程模型进行形式化和分析,假设:(i) 每次攻击经过一个或多个步骤才能导致系统安全失败;(ii) 针对这些中间步骤的防御性响应可能只能偶尔制止攻击;(iii) 发现攻击完成后合理的重置响应可能始终无法从安全失败中恢复。分析表明,即使在完美探测器的理想情况下,在攻击期间采用防御性响应可能在长期内是次优的;即, Depending on attack dynamics and response effectiveness,ongoing 防御措施的总开销可能超过间歇性安全失败的总风险。分析同样考察了就业预防性重置的可用性损失与风险降低,阐明了决定系统恢复是以被动还是主动方式启动的关键因素。我们还讨论了模型的扩展和相关工作,旨在针对具有 (i) 不完美或可控探测器、(ii) 多种攻击类型、(iii) 连续时间动态或 (iv) 战略性攻击者的入侵容错应用进行探讨。
引用
@article{arxiv.2509.07919,
title = {A Markov Decision Process Model for Intrusion Tolerance Problems},
author = {Patrick Kreidl},
journal= {arXiv preprint arXiv:2509.07919},
year = {2025}
}
备注
19 pages, 9 figures, unpublished/rejected manuscript circa 2010