中文

maxDNN:一种用于 Maxwell GPU 深度学习的高效卷积核

神经与进化计算 2015-02-03 v3 分布式、并行与集群计算 机器学习

摘要

本文介绍了 maxDNN,这是一种用于 NVIDIA Maxwell GPU 深度学习的计算高效卷积核。maxDNN 在典型的深度学习网络架构上达到了 96.3% 的计算效率。该设计结合了 cuda-convnet2 的思想与 Maxas SGEMM 汇编代码。我们仅处理网络的前向传播(FPROP)操作,但我们相信此处使用的相同技术对于反向传播(BPROP)同样有效。

关键词

引用

@article{arxiv.1501.06633,
  title  = {maxDNN: An Efficient Convolution Kernel for Deep Learning with Maxwell GPUs},
  author = {Andrew Lavin},
  journal= {arXiv preprint arXiv:1501.06633},
  year   = {2015}
}

备注

7 pages, 2 figures, 1 table