将 DDalphaAMG 求解器移植至 K 计算机
高能物理 - 格点
2019-04-02 v2 计算物理
摘要
我们将域分解-alpha-AMG (Domain-Decomposed-alpha-AMG) 求解器移植到 K 计算机。该系统每节点有 8 核和 16 GB 内存,理论峰值 128 GFlops(总计 82,944 节点)。其特性——每核多达 256 个寄存器、高达 0.5 byte/Flop 的比例——要求不同于其他机器的调优。为使用更多寄存器,我们更改了部分数据结构并用内建函数重写矩阵-向量运算。包含 setup 的十二次求解性能提升超过两倍。优化后效率仍约为 5%,低于先前为 K 计算机调优的混合精度求解器的 22%。但物理点构型的吞吐量却优于两倍以上。
引用
@article{arxiv.1811.00355,
title = {Porting DDalphaAMG solver to K computer},
author = {Ken-Ichi Ishikawa and Issaku Kanamori},
journal= {arXiv preprint arXiv:1811.00355},
year = {2019}
}
备注
7 pages, 3 figures, Proceedings of The 36th Annual International Symposium on Lattice Field Theory - Lattice 2018, 22-28 July, 2018; v2: Minor typos corrected