在 Summit 上以 OpenMP 指令面向 GPU:一种简单有效的 Fortran 实践
计算物理
2019-09-09 v2 天体物理仪器与方法
分布式、并行与集群计算
摘要
我们使用 OpenMP 在 Summit(橡树岭领导计算设施 OLCF 新部署的超级计算机)上面向硬件加速器(GPU),展示了我们的天体物理代码 GenASiS 用户对 GPU 设备的简化访问,以及一个流体动力学样例问题的有效加速。我们修改了用于数据存储的主力类,以包含显著简化 GPU 内存持久分配与关联的成员和方法。用户使用与多核并行化中已熟悉的构造相当类似的 OpenMP target 指令卸载计算内核。在此初始示例中我们问:“给定数量的 Summit 节点下,使用与不使用 GPU 的计算速度分别为多快?”,并发现总墙钟时间加速比约为 。我们还发现了直至 8000 个 GPU(1334 个 Summit 节点)的合理弱缩放。我们在 https://github.com/GenASiS/GenASiS_Basics 提供了本工作的源代码。
引用
@article{arxiv.1812.07977,
title = {Targeting GPUs with OpenMP Directives on Summit: A Simple and Effective Fortran Experience},
author = {Reuben D. Budiardja and Christian Y. Cardall},
journal= {arXiv preprint arXiv:1812.07977},
year = {2019}
}
备注
Version accepted by Parallel Computing: Systems and Applications