初步报告:面向HPC的AMD GPU上StdPar实现的初始评估
分布式、并行与集群计算
2024-01-08 v1 性能
摘要
近期,AMD平台不支持将C++17 PSTL(StdPar)程序卸载到GPU。我们之前的工作强调了StdPar如何在NVIDIA和Intel GPU平台上实现良好性能。在那项工作中,我们承认了AMD过去的努力,如HCC,但遗憾的是它已被弃用且不支持较新的硬件平台。AMD、Codeplay和AdaptiveCpp(以前称为hipSYCL或OpenSYCL)的最新发展,为StdPar程序在AMD GPU上运行提供了多种路径。本非正式报告讨论了我们在AMD GPU上对当前可用StdPar实现的体验和评估。我们使用一套HPC微型应用程序进行基准测试,这些应用程序具有多种异构编程模型的端口,包括StdPar。然后,我们使用所有可用的StdPar编译器,将StdPar的性能与AMD GPU上支持的当代异构编程模型(HIP、OpenCL、Thrust、Kokkos、OpenMP、SYCL)进行比较。在适当的情况下,我们讨论了评估中遇到的问题和采用的解决方法。最后,本报告中讨论的StdPar模型在很大程度上依赖于统一共享内存(USM)性能,而很少有AMD GPU对此功能有适当支持。因此,本报告为使用HIP API的模型展示了一个概念验证的主机端用户空间缺页解决方案。我们使用相同的基准测试集讨论了我们的解决方案所实现的性能改进。
引用
@article{arxiv.2401.02680,
title = {Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC},
author = {Wei-Chen Lin and Simon McIntosh-Smith and Tom Deakin},
journal= {arXiv preprint arXiv:2401.02680},
year = {2024}
}
备注
This is a preliminary report intended as early feedback for interested vendors. Report contains 11 pages and 16 figures