论代码与代理应用中计算内核的相似性
分布式、并行与集群计算
2026-05-11 v1
摘要
随着高性能计算(HPC)系统快速发展,节点内并行度不断增加且加速器被广泛使用,理解代码如何映射到硬件对于达到最优性能至关重要。基准测试通常用于早期评估新兴架构(并为未来硬件的设计提供参考),但基准测试能在多大程度上代表仿真代码的性能特征通常是未知的。评估基准测试能在多大程度上代表我们的 HPC 代码的现有方法是手动的、劳动密集型的,并且难以扩展到许多基准测试。在本文中,我们基于代码使用计算硬件的方式提出了性能相似度指标。我们定义并刻画了两大类表现出相似性能特征的内核。我们在 Kripke 代理应用和 RAJA Performance Suite 中的内核上评估了成对相似度指标,同时使用了纯 CPU 系统和 GPU 加速系统。我们验证了我们的相似度指标能将 Kripke 代理应用中的一个内核正确匹配到 RAJA Performance Suite 中的一个内核。我们提出的相似度指标能够评估我们代码中的计算内核与用于代表这些代码的代理应用之间的相似度。
引用
@article{arxiv.2605.06968,
title = {On Similarity of Computational Kernels in our Codes and Proxies},
author = {Michael McKinsey and Stephanie Brink and Olga Pearce},
journal= {arXiv preprint arXiv:2605.06968},
year = {2026}
}
备注
11 pages; to appear at ICS Workshops 2026