maxDNN:一种用于 Maxwell GPU 深度学习的高效卷积核
神经与进化计算
2015-02-03 v3 分布式、并行与集群计算
机器学习
摘要
本文介绍了 maxDNN,这是一种用于 NVIDIA Maxwell GPU 深度学习的计算高效卷积核。maxDNN 在典型的深度学习网络架构上达到了 96.3% 的计算效率。该设计结合了 cuda-convnet2 的思想与 Maxas SGEMM 汇编代码。我们仅处理网络的前向传播(FPROP)操作,但我们相信此处使用的相同技术对于反向传播(BPROP)同样有效。
引用
@article{arxiv.1501.06633,
title = {maxDNN: An Efficient Convolution Kernel for Deep Learning with Maxwell GPUs},
author = {Andrew Lavin},
journal= {arXiv preprint arXiv:1501.06633},
year = {2015}
}
备注
7 pages, 2 figures, 1 table