中文

Fortran 的 `do concurrent' 在 GPU 上的可移植性

编程语言 2024-12-25 v2 太阳与恒星天体物理 计算工程、金融与科学 数学软件 性能

摘要

人们持续关注使用标准语言构造进行加速计算,以避免(有时是特定厂商的)外部 API。对于 Fortran 代码,{\tt do concurrent}(DC)循环已在 NVIDIA 平台上成功演示。然而,其他平台对 DC 的支持实现时间更长。最近,Intel 已在其编译器中添加了 DC GPU 卸载支持,HPE 也为 AMD GPU 提供了类似支持。本文使用在研的太阳表面通量演化代码 HipFT,探讨了 DC 在不同 GPU 厂商之间的当前可移植性。我们讨论了实现和编译细节,包括与使用统一内存系统相比,何时/何地使用指令式 API 进行数据移动是必要的/期望的。展示了数据中心平台和消费级平台上的性能表现。

关键词

引用

@article{arxiv.2408.07843,
  title  = {Portability of Fortran's `do concurrent' on GPUs},
  author = {Ronald M. Caplan and Miko M. Stulajter and Jon A. Linker and Jeff Larkin and Henry A. Gabb and Shiquan Su and Ivan Rodriguez and Zachary Tschirhart and Nicholas Malaya},
  journal= {arXiv preprint arXiv:2408.07843},
  year   = {2024}
}

备注

10 pages, 7 figures, To appear in the workshop proceedings of WACCPD24 at SC24