利用 BLIS 框架为搭载 Epiphany 协处理器加速的 Parallella 平台生成单精度 BLAS 库
分布式、并行与集群计算
2016-11-17 v1
摘要
Parallella 是一个混合计算平台,源于 Adapteva 发起的一个 Kickstarter 项目。它由高性能、高能效的众核架构 Epiphany 芯片(用作协处理器)和一个 Zynq-7000 系列芯片组成,后者通常运行常规 Linux 操作系统版本,充当主处理器,并在其内部 FPGA 中实现“胶合逻辑”以与 Parallella 中的众多接口通信。本文为 Parallella 平台创建了一个经 Epiphany 加速的 BLAS 库(该库也可能适用于包含 Epiphany 芯片作为协处理器的类似混合平台)。对于 BLAS 的实际实例化,使用了 BLIS 框架。此前在该平台上已有矩阵-矩阵乘法的实现,其在 Epiphany 芯片内部取得了非常好的性能(高达峰值的 85%),但由于芯片间数据传输带宽的限制,在整个 Parallella 平台上的性能并不理想。本工作的主要目的是着眼于科学计算,使整个 Parallella 平台更接近实用的线性代数应用。
引用
@article{arxiv.1608.05265,
title = {Generation of the Single Precision BLAS library for the Parallella platform, with Epiphany co-processor acceleration, using the BLIS framework},
author = {Miguel Tasende},
journal= {arXiv preprint arXiv:1608.05265},
year = {2016}
}
备注
8 pages, 9 figures, conference manuscript for IEEE DataCom 2016 (Auckland, New Zealand)