中文

将 DDalphaAMG 求解器移植至 K 计算机

高能物理 - 格点 2019-04-02 v2 计算物理

摘要

我们将域分解-alpha-AMG (Domain-Decomposed-alpha-AMG) 求解器移植到 K 计算机。该系统每节点有 8 核和 16 GB 内存,理论峰值 128 GFlops(总计 82,944 节点)。其特性——每核多达 256 个寄存器、高达 0.5 byte/Flop 的比例——要求不同于其他机器的调优。为使用更多寄存器,我们更改了部分数据结构并用内建函数重写矩阵-向量运算。包含 setup 的十二次求解性能提升超过两倍。优化后效率仍约为 5%,低于先前为 K 计算机调优的混合精度求解器的 22%。但物理点构型的吞吐量却优于两倍以上。

关键词

引用

@article{arxiv.1811.00355,
  title  = {Porting DDalphaAMG solver to K computer},
  author = {Ken-Ichi Ishikawa and Issaku Kanamori},
  journal= {arXiv preprint arXiv:1811.00355},
  year   = {2019}
}

备注

7 pages, 3 figures, Proceedings of The 36th Annual International Symposium on Lattice Field Theory - Lattice 2018, 22-28 July, 2018; v2: Minor typos corrected