异步崩溃-恢复领导者选举算法的服务质量
分布式、并行与集群计算
2017-04-24 v1
摘要
在异步分布式系统中,很难评估参与计算的一个进程是在正常运行还是已经失败。为克服此问题,人们利用不可靠故障检测器来构建分布式算法,这些检测器以抽象方式捕获评估进程运行状态所需的时序假设。一种特定类型的故障检测器是领导者选举,它指示一个未失败的进程。这些故障检测器的不可靠性意味着它们可能出错,然而若要在实践中使用,这些检测器的最终行为必须有界限。这些界限被定义为检测器提供的服务质量(QoS)。许多工作致力于构建具有可预测QoS的故障检测器,但仅针对崩溃-停止进程和同步系统。本文提出并分析了一种新的领导者选举算法NFD-L在异步崩溃-恢复故障模型下的行为,该算法在稳定内存和消息交换的使用方面是高效的。
引用
@article{arxiv.1704.06302,
title = {Quality of Service of an Asynchronous Crash-Recovery Leader Election Algorithm},
author = {Vinícius A. Reis and Gustavo M. D. Vieira},
journal= {arXiv preprint arXiv:1704.06302},
year = {2017}
}
备注
14 pages, published in the Proc. of the 35th Brazilian Symposium on Computer Networks, Belem, Brazil, May 2017