非对称 big.LITTLE 处理器上矩阵乘法的性能与能耗优化
分布式、并行与集群计算
2015-07-21 v1
摘要
非对称处理器已成为一种对能源严重受限环境极具吸引力的技术,尤其是在应用异构性为主流的移动市场。此外,鉴于高性能计算对超低功耗架构日益增长的兴趣,这类平台也在实现高能效高性能科学应用的道路上被研究。在本文中,我们提出了向适配非对称 ARM big.LITTLE 处理器的完整 BLAS 接口实现迈出的第一步,分析了与现有同构(对称)多线程 BLAS 实现相比时性能和能效之间的权衡。我们的实验结果表明,通过有效利用非对称处理器的所有资源,在保持同构解决方案能效的同时,性能获得了显著提升。
引用
@article{arxiv.1507.05129,
title = {Performance and Energy Optimization of Matrix Multiplication on Asymmetric big.LITTLE Processors},
author = {Sandra Catalán and Francisco D. Igual and Rafael Mayo and Luis Piñuel and Enrique S. Quintana-Ortí and Rafael Rodríguez-Sánchez},
journal= {arXiv preprint arXiv:1507.05129},
year = {2015}
}
备注
Presented at HiPEAC 2015, Amsterdam. Foundation of the Asymmetric BLIS implementation