从裸金属到虚拟化:一个超算机构部署其首个云的经验和教训
分布式、并行与集群计算
2018-07-24 v1
摘要
作为明尼苏达大学研究计算服务的主要提供者,明尼苏达超算研究所(MSI)长期负责服务数以千计的用户需求。近年来,MSI——如同许多其他HPC中心——观察到对自助式、按需、数据密集型研究的日益增长需求,以及许多用于研究目的的新受控访问数据集的出现。有鉴于此,MSI构建了一项新的本地云服务,名为Stratus,其从底层架构设计以轻松满足数据使用协议并填补传统HPC留下的四个空白。由此产生的OpenStack云由HPC专用计算节点构成,并以Ceph存储为支撑,旨在完全符合NIH基因组数据共享政策所设定的管控要求。在此,我们呈现了在不到18个月内将Stratus从构想带入生产的雄心冲刺中所获得的十二条经验教训。这一时间线中重要且常被忽视的组成部分包括新领导角色的设立、员工与用户培训,以及用户支持文档的编写。在此过程中,所得经验教训远远超出了通常与获取、配置和维护大规模系统相关的技术挑战。
引用
@article{arxiv.1807.08654,
title = {From Bare Metal to Virtual: Lessons Learned when a Supercomputing Institute Deploys its First Cloud},
author = {Evan F. Bollig and James C. Wilgenbusch},
journal= {arXiv preprint arXiv:1807.08654},
year = {2018}
}
备注
8 pages, 5 figures, PEARC '18: Practice and Experience in Advanced Research Computing, July 22--26, 2018, Pittsburgh, PA, USA