中文

不规则波前传播模式在众核架构上的高效执行

分布式、并行与集群计算 2016-05-04 v1

摘要

图像处理算法的高效执行是生物信息学的一个活跃领域。在图像处理中,一类处理不规则数据结构的算法或计算模式是不规则波前传播模式(IWPP)。在这类算法中,元素以波传播的形式向邻居传播信息。这种传播导致对数据的不规则访问和扩展。由于这种不规则性,当前此类算法的实现需要原子操作,这代价高昂,并且限制了在众核(MIC)架构上使用单指令多数据(SIMD)指令的实现,而SIMD指令对于在该处理器上获得高性能至关重要。本研究的目标是重新设计不规则波前传播模式算法,以便能够使用SIMD指令在具有众核架构的处理器上高效执行。在这项工作中,我们使用英特尔(R)至强融核(TM)协处理器,实现了IWPP的向量化版本,相比非向量化版本获得了高达5.63倍的增益;实现了使用先进先出(FIFO)队列的并行版本,与协处理器上的单核版本相比,加速比高达55倍;实现了使用优先级队列的版本,其性能比文献中可用的基于GPU的最快实现版本好1.62倍;还实现了一个异构处理器间的协作版本,允许处理大于英特尔(R)至强融核(TM)内存的图像,并提供了一种在计算中利用所有可用设备的方法。

关键词

引用

@article{arxiv.1605.00930,
  title  = {Efficient Execution of Irregular Wavefront Propagation Pattern on Many Integrated Core Architecture},
  author = {Jeremias Gomes and George Teodoro},
  journal= {arXiv preprint arXiv:1605.00930},
  year   = {2016}
}

备注

in Portuguese