中文

异步崩溃-恢复领导者选举算法的服务质量

分布式、并行与集群计算 2017-04-24 v1

摘要

在异步分布式系统中,很难评估参与计算的一个进程是在正常运行还是已经失败。为克服此问题,人们利用不可靠故障检测器来构建分布式算法,这些检测器以抽象方式捕获评估进程运行状态所需的时序假设。一种特定类型的故障检测器是领导者选举,它指示一个未失败的进程。这些故障检测器的不可靠性意味着它们可能出错,然而若要在实践中使用,这些检测器的最终行为必须有界限。这些界限被定义为检测器提供的服务质量(QoS)。许多工作致力于构建具有可预测QoS的故障检测器,但仅针对崩溃-停止进程和同步系统。本文提出并分析了一种新的领导者选举算法NFD-L在异步崩溃-恢复故障模型下的行为,该算法在稳定内存和消息交换的使用方面是高效的。

关键词

引用

@article{arxiv.1704.06302,
  title  = {Quality of Service of an Asynchronous Crash-Recovery Leader Election Algorithm},
  author = {Vinícius A. Reis and Gustavo M. D. Vieira},
  journal= {arXiv preprint arXiv:1704.06302},
  year   = {2017}
}

备注

14 pages, published in the Proc. of the 35th Brazilian Symposium on Computer Networks, Belem, Brazil, May 2017