中文

非对称 big.LITTLE 处理器上矩阵乘法的性能与能耗优化

分布式、并行与集群计算 2015-07-21 v1

摘要

非对称处理器已成为一种对能源严重受限环境极具吸引力的技术,尤其是在应用异构性为主流的移动市场。此外,鉴于高性能计算对超低功耗架构日益增长的兴趣,这类平台也在实现高能效高性能科学应用的道路上被研究。在本文中,我们提出了向适配非对称 ARM big.LITTLE 处理器的完整 BLAS 接口实现迈出的第一步,分析了与现有同构(对称)多线程 BLAS 实现相比时性能和能效之间的权衡。我们的实验结果表明,通过有效利用非对称处理器的所有资源,在保持同构解决方案能效的同时,性能获得了显著提升。

关键词

引用

@article{arxiv.1507.05129,
  title  = {Performance and Energy Optimization of Matrix Multiplication on Asymmetric big.LITTLE Processors},
  author = {Sandra Catalán and Francisco D. Igual and Rafael Mayo and Luis Piñuel and Enrique S. Quintana-Ortí and Rafael Rodríguez-Sánchez},
  journal= {arXiv preprint arXiv:1507.05129},
  year   = {2015}
}

备注

Presented at HiPEAC 2015, Amsterdam. Foundation of the Asymmetric BLIS implementation