Fortran 的 `do concurrent' 在 GPU 上的可移植性
编程语言
2024-12-25 v2 太阳与恒星天体物理
计算工程、金融与科学
数学软件
性能
摘要
人们持续关注使用标准语言构造进行加速计算,以避免(有时是特定厂商的)外部 API。对于 Fortran 代码,{\tt do concurrent}(DC)循环已在 NVIDIA 平台上成功演示。然而,其他平台对 DC 的支持实现时间更长。最近,Intel 已在其编译器中添加了 DC GPU 卸载支持,HPE 也为 AMD GPU 提供了类似支持。本文使用在研的太阳表面通量演化代码 HipFT,探讨了 DC 在不同 GPU 厂商之间的当前可移植性。我们讨论了实现和编译细节,包括与使用统一内存系统相比,何时/何地使用指令式 API 进行数据移动是必要的/期望的。展示了数据中心平台和消费级平台上的性能表现。
引用
@article{arxiv.2408.07843,
title = {Portability of Fortran's `do concurrent' on GPUs},
author = {Ronald M. Caplan and Miko M. Stulajter and Jon A. Linker and Jeff Larkin and Henry A. Gabb and Shiquan Su and Ivan Rodriguez and Zachary Tschirhart and Nicholas Malaya},
journal= {arXiv preprint arXiv:2408.07843},
year = {2024}
}
备注
10 pages, 7 figures, To appear in the workshop proceedings of WACCPD24 at SC24