在Xeon Phi上评估核函数以加速Gysela应用
计算物理
2015-08-04 v2 分布式、并行与集群计算
性能
摘要
本工作描述了将Gysela代码的部分移植到Intel Xeon Phi协处理器所面临的挑战,以及用于优化、向量化和调优的技术,这些技术可应用于其他应用。我们评估了某些通用微基准测试在Phi上与Intel Sandy Bridge上的性能。分析了对Gysela应用有用的若干插值核函数并展示了性能。与Sandy架构相比,一些受内存限制和受计算限制的内核在Phi设备上加速了2倍。然而,即便不是不可能,也很难在Phi设备上达到其峰值性能的很大一部分,特别是对于如Gysela这样的实际应用程序。这项优化和调优工作的一个附带好处是,Gysela(使用4D平流)在标准架构如Intel Sandy Bridge上的执行时间减少了。
引用
@article{arxiv.1503.04645,
title = {Evaluating kernels on Xeon Phi to accelerate Gysela application},
author = {G. Latu and M. Haefele and J. Bigot and V. Grandgirard and T. Cartier-Michaud and F. Rozar},
journal= {arXiv preprint arXiv:1503.04645},
year = {2015}
}
备注
submitted to ESAIM proceedings for CEMRACS 2014 summer school version reviewed