中文

利用已达服务时间报告改进大规模系统中的负载均衡

分布式、并行与集群计算 2021-04-16 v2

摘要

我们的兴趣在于由多个调度器和 FCFS(先来先服务)服务器组成的大规模系统中作业的负载均衡。在缺乏作业大小信息的情形下,调度器通常利用服务器报告的队列长度信息来分配到达的作业。当作业大小高度可变时,仅使用队列长度信息显然不是最优的,若能向调度器提供关于正在进行的作业大小的一些指示,性能便可改善。在 FCFS 服务器中,测量正在进行的作业的已达服务时间是容易的,因此服务器在被调度器查询时可将该已达服务时间与队列长度一并报告。本文提出并分析了一系列利用队列长度和已达服务时间来分配作业的负载均衡策略,以及仅使用服务中作业的已达服务时间的策略。我们在通常的渐近独立假设下,对大规模系统中所有这些策略给出了统一分析。所提分析的精确性通过仿真得以验证。我们给出了广泛的数值实验,明确表明在服务器队列长度信息之外使用已达服务时间信息可显著改善等待时间(从而也改善响应时间)。此外,不使用队列长度的策略在中等负载系统中仍提供了改善的等待时间。

关键词

引用

@article{arxiv.2011.08250,
  title  = {Improved Load Balancing in Large Scale Systems using Attained Service Time Reporting},
  author = {Tim Hellemans and Benny Van Houdt},
  journal= {arXiv preprint arXiv:2011.08250},
  year   = {2021}
}