Computation and Language · Computer Science
Efficient Large-Scale Language Model Training on GPU Clusters Using Megatron-LM
Deepak Narayanan, Mohammad Shoeybi, Jared Casper, Patrick LeGresley +8
2021-08-25
Machine Learning · Computer Science
Training EfficientNets at Supercomputer Scale: 83% ImageNet Top-1 Accuracy in One Hour
Arissa Wongpanich, Hieu Pham, James Demmel, Mingxing Tan +3
2020-11-06
Machine Learning · Computer Science
Computation-Aware Gaussian Processes: Model Selection And Linear-Time Inference
Jonathan Wenger, Kaiwen Wu, Philipp Hennig, Jacob R. Gardner +2
2025-07-08
Computation and Language · Computer Science
$100K or 100 Days: Trade-offs when Pre-Training with Academic Resources
Apoorv Khandelwal, Tian Yun, Nihal V. Nayak, Jack Merullo +3
2025-09-29
Image and Video Processing · Electrical Eng. & Systems
Training Multiscale-CNN for Large Microscopy Image Classification in One Hour
Kushal Datta, Imtiaz Hossain, Sun Choi, Vikram Saletore +3
2020-03-12
Machine Learning · Computer Science
Large-Scale Stochastic Learning using GPUs
Thomas Parnell, Celestine Dünner, Kubilay Atasu, Manolis Sifalakis +1
2017-02-24
Computer Vision and Pattern Recognition · Computer Science
Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model
Team Seawead, Ceyuan Yang, Zhijie Lin, Yang Zhao +51
2025-05-06
Computer Vision and Pattern Recognition · Computer Science
Training a Vision Transformer from scratch in less than 24 hours with 1 GPU
Saghar Irandoust, Thibaut Durand, Yunduz Rakhmangulova, Wenjie Zi +1
2022-11-11
Machine Learning · Computer Science
Gear Training: A new way to implement high-performance model-parallel training
Hao Dong, Shuai Li, Dongchang Xu, Yi Ren +1
2018-06-12
Computer Vision and Pattern Recognition · Computer Science
Compressed Vision for Efficient Video Understanding
Olivia Wiles, Joao Carreira, Iain Barr, Andrew Zisserman +1
2022-10-07
Computer Vision and Pattern Recognition · Computer Science
GigaVideo-1: Advancing Video Generation via Automatic Feedback with 4 GPU-Hours Fine-Tuning
Xiaoyi Bao, Jindi Lv, Xiaofeng Wang, Zheng Zhu +5
2025-06-13
Computation and Language · Computer Science
MegaTrain: Full Precision Training of 100B+ Parameter Large Language Models on a Single GPU
Zhengqing Yuan, Hanchi Sun, Lichao Sun, Yanfang Ye
2026-04-08
Computer Vision and Pattern Recognition · Computer Science
Accelerating the Training of Video Super-Resolution Models
Lijian Lin, Xintao Wang, Zhongang Qi, Ying Shan
2022-05-18
Distributed, Parallel, and Cluster Computing · Computer Science
HETHUB: A Distributed Training System with Heterogeneous Cluster for Large-Scale Models
Si Xu, Zixiao Huang, Yan Zeng, Shengen Yan +10
2024-08-12
Hardware Architecture · Computer Science
Understanding Training Efficiency of Deep Learning Recommendation Models at Scale
Bilge Acun, Matthew Murphy, Xiaodong Wang, Jade Nie +2
2020-11-12
Computer Vision and Pattern Recognition · Computer Science
A Multigrid Method for Efficiently Training Video Models
Chao-Yuan Wu, Ross Girshick, Kaiming He, Christoph Feichtenhofer +1
2020-06-11
Computer Vision and Pattern Recognition · Computer Science
MUG-V 10B: High-efficiency Training Pipeline for Large Video Generation Models
Yongshun Zhang, Zhongyi Fan, Yonghang Zhang, Zhangzikang Li +5
2025-10-23
Distributed, Parallel, and Cluster Computing · Computer Science
Efficient Fine-Grained GPU Performance Modeling for Distributed Deep Learning of LLM
Biyao Zhang, Mingkai Zheng, Debargha Ganguly, Xuecen Zhang +3
2025-09-30
Computer Vision and Pattern Recognition · Computer Science
Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour
Priya Goyal, Piotr Dollár, Ross Girshick, Pieter Noordhuis +5
2018-05-02
Machine Learning · Computer Science
Yet Another Accelerated SGD: ResNet-50 Training on ImageNet in 74.7 seconds
Masafumi Yamazaki, Akihiko Kasagi, Akihiro Tabuchi, Takumi Honda +5
2019-04-01
Machine Learning · Computer Science
M6-10T: A Sharing-Delinking Paradigm for Efficient Multi-Trillion Parameter Pretraining
Junyang Lin, An Yang, Jinze Bai, Chang Zhou +8
2021-10-26