在Numba即时编译的蒙特卡罗粒子输运代码MC/DC中实现GPU可移植性
计算物理
2025-05-30 v2
摘要
百亿亿次蒙特卡罗中子输运中心正在开发蒙特卡罗/动态代码(MC/DC),将其作为一个可移植的蒙特卡罗中子输运软件包,用于在基于CPU和GPU的高性能计算机上进行快速数值方法探索。本文描述了MC/DC当前基于事件的GPU算法,以及我们用于从MC/DC的Python源代码在Nvidia和AMD GPU上实现GPU可操作性的即时编译方案。为了分析性能,我们在Nvidia Tesla V100 GPU、AMD MI250X GPU和AMD MI300A APU上对C5G7 k-特征值基准问题和连续能量无限栅元进行了运行时测试,并与双插槽Intel Xeon Sapphire Rapid CPU节点进行了比较。我们发现,对于多群C5G7基准问题,在V100、MI250X和MI300A上相对于112个Intel Xeon CPU核心分别获得了15倍、0.7倍和12倍的加速。对于连续能量无限栅元基准,在V100、MI250X和MI300A上相对于同一CPU节点分别获得了5倍、3倍和4倍的加速。
引用
@article{arxiv.2501.05440,
title = {Enabling GPU Portability into the Numba-JITed Monte Carlo Particle Transport Code MC/DC},
author = {Joanna Piper Morgan and Braxton Cuneo and Ilham Variansyah and Kyle E. Niemeyer},
journal= {arXiv preprint arXiv:2501.05440},
year = {2025}
}
备注
10 pages, 3 figures. Special Session on Research Activities of the Center for Exascale Monte Carlo Neutron Transport