Machine Learning · Computer Science
Yet Another Accelerated SGD: ResNet-50 Training on ImageNet in 74.7 seconds
Masafumi Yamazaki, Akihiko Kasagi, Akihiro Tabuchi, Takumi Honda +5
2019-04-01
Computer Vision and Pattern Recognition · Computer Science
ImageNet Training in Minutes
Yang You, Zhao Zhang, Cho-Jui Hsieh, James Demmel +1
2018-02-01
Machine Learning · Statistics
Scale out for large minibatch SGD: Residual network training on ImageNet-1K with improved accuracy and reduced time to train
Valeriu Codreanu, Damian Podareanu, Vikram Saletore
2017-11-17
Machine Learning · Computer Science
Highly Scalable Deep Learning Training System with Mixed-Precision: Training ImageNet in Four Minutes
Xianyan Jia, Shutao Song, Wei He, Yangzihao Wang +10
2018-07-31
Computer Vision and Pattern Recognition · Computer Science
Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour
Priya Goyal, Piotr Dollár, Ross Girshick, Pieter Noordhuis +5
2018-05-02
Machine Learning · Computer Science
Massively Distributed SGD: ImageNet/ResNet-50 Training in a Flash
Hiroaki Mikami, Hisahiro Suganuma, Pongsakorn U-chupala, Yoshiki Tanaka +1
2019-03-06
Machine Learning · Computer Science
Image Classification at Supercomputer Scale
Chris Ying, Sameer Kumar, Dehao Chen, Tao Wang +1
2018-12-04
Distributed, Parallel, and Cluster Computing · Computer Science
Efficient Training of Convolutional Neural Nets on Large Distributed Systems
Sameer Kumar, Dheeraj Sreedhar, Vaibhav Saxena, Yogish Sabharwal +1
2017-11-03
Machine Learning · Computer Science
Training EfficientNets at Supercomputer Scale: 83% ImageNet Top-1 Accuracy in One Hour
Arissa Wongpanich, Hieu Pham, James Demmel, Mingxing Tan +3
2020-11-06
Distributed, Parallel, and Cluster Computing · Computer Science
PowerAI DDL
Minsik Cho, Ulrich Finkler, Sameer Kumar, David Kung +2
2017-08-08
Machine Learning · Computer Science
Large Scale Language Modeling: Converging on 40GB of Text in Four Hours
Raul Puri, Robert Kirby, Nikolai Yakovenko, Bryan Catanzaro
2018-08-14
Machine Learning · Computer Science
Improving Resnet-9 Generalization Trained on Small Datasets
Omar Mohamed Awad, Habib Hajimolahoseini, Michael Lim, Gurpreet Gosal +3
2025-05-27
Distributed, Parallel, and Cluster Computing · Computer Science
Optimizing Network Performance for Distributed DNN Training on GPU Clusters: ImageNet/AlexNet Training in 1.5 Minutes
Peng Sun, Wansen Feng, Ruobing Han, Shengen Yan +1
2019-10-23
Machine Learning · Computer Science
DistGNN-MB: Distributed Large-Scale Graph Neural Network Training on x86 via Minibatch Sampling
Md Vasimuddin, Ramanarayan Mohanty, Sanchit Misra, Sasikanth Avancha
2022-11-14
Machine Learning · Computer Science
The Limit of the Batch Size
Yang You, Yuhui Wang, Huan Zhang, Zhao Zhang +2
2020-06-16
Machine Learning · Computer Science
Accelerating Training and Inference of Graph Neural Networks with Fast Sampling and Pipelining
Tim Kaler, Nickolas Stathas, Anne Ouyang, Alexandros-Stavros Iliopoulos +3
2022-03-18
Machine Learning · Computer Science
Don't Decay the Learning Rate, Increase the Batch Size
Samuel L. Smith, Pieter-Jan Kindermans, Chris Ying, Quoc V. Le
2018-02-27
Image and Video Processing · Electrical Eng. & Systems
Training Multiscale-CNN for Large Microscopy Image Classification in One Hour
Kushal Datta, Imtiaz Hossain, Sun Choi, Vikram Saletore +3
2020-03-12
Computer Vision and Pattern Recognition · Computer Science
MegDet: A Large Mini-Batch Object Detector
Chao Peng, Tete Xiao, Zeming Li, Yuning Jiang +4
2018-04-12
Computer Vision and Pattern Recognition · Computer Science
How far can we go with ImageNet for Text-to-Image generation?
L. Degeorge, A. Ghosh, N. Dufour, D. Picard +1
2025-10-03