ScotGrid:在 LHC 时代提供有效的分布式二级计算中心
分布式、并行与集群计算
2010-05-25 v1
摘要
ScotGrid 是英国的一个分布式二级计算中心,站点位于达勒姆、爱丁堡和格拉斯哥。为迎接 LHC,ScotGrid 的硬件进行了大规模扩展,现在为 LHC 虚拟组织提供超过 4MSI2K 和 500TB 的资源。将规模提升到这一水平给二级计算中心带来了许多挑战,我们在本文中展示了如何采用新的方法来组织中心,从结构管理和监控到站点的远程管理以及管理和操作流程,以应对这些挑战。我们描述了如何应对各站点不同的运营模式,其中格拉斯哥和达勒姆站点是“内部”管理的,但爱丁堡的资源是作为中央大学资源管理的。这需要在爱丁堡采用不同的结构管理模式,并与集群管理人员进行特殊合作。本地和网格提交的不同作业模型带来了挑战,需要特别关注才能解决。我们展示了 ScotGrid 如何成功地为 ATLAS 和 LHCb 的蒙特卡罗生产提供了基础设施。特别关注确保用户分析高效运行,这需要优化本地存储和网络以应对用户分析的需求。最后,尽管这些二级计算中心资源是承诺给整个虚拟组织的,但我们已与本地物理用户社区建立了密切联系,认为这是确保二级计算中心作为 LHC 网格计算框架一部分有效运行的最佳方式。
引用
@article{arxiv.0910.4507,
title = {ScotGrid: Providing an Effective Distributed Tier-2 in the LHC Era},
author = {Sam Skipsey and David Ambrose-Griffith and Greig Cowan and Mike Kenyon and Orlando Richards and Phil Roffe and Graeme Stewart},
journal= {arXiv preprint arXiv:0910.4507},
year = {2010}
}
备注
Preprint for 17th International Conference on Computing in High Energy and Nuclear Physics, 7 pages, 1 figure