Distributed, Parallel, and Cluster Computing · Computer Science
Optimizing Distributed Training Approaches for Scaling Neural Networks
Vishnu Vardhan Baligodugula, Fathi Amsaad
2025-04-01
Distributed, Parallel, and Cluster Computing · Computer Science
Hulk: Graph Neural Networks for Optimizing Regionally Distributed Computing Systems
Zhengqing Yuan, Huiwen Xue, Chao Zhang, Yongming Liu
2023-04-14
Distributed, Parallel, and Cluster Computing · Computer Science
Automatic Model Parallelism for Deep Neural Networks with Compiler and Hardware Support
Sanket Tavarageri, Srinivas Sridharan, Bharat Kaul
2019-06-20
Machine Learning · Computer Science
Parallel Training of Deep Networks with Local Updates
Michael Laskin, Luke Metz, Seth Nabarro, Mark Saroufim +4
2021-06-16
Machine Learning · Computer Science
A Survey and Empirical Evaluation of Parallel Deep Learning Frameworks
Daniel Nichols, Siddharth Singh, Shu-Huai Lin, Abhinav Bhatele
2022-07-04
Distributed, Parallel, and Cluster Computing · Computer Science
Distributed Training Large-Scale Deep Architectures
Shang-Xuan Zou, Chun-Yen Chen, Jui-Lin Wu, Chun-Nan Chou +5
2017-09-21
Distributed, Parallel, and Cluster Computing · Computer Science
Improving Strong-Scaling of CNN Training by Exploiting Finer-Grained Parallelism
Nikoli Dryden, Naoya Maruyama, Tom Benson, Tim Moon +2
2019-03-18
Distributed, Parallel, and Cluster Computing · Computer Science
Parallel/distributed implementation of cellular training for generative adversarial neural networks
Emiliano Perez, Sergio Nesmachnow, Jamal Toutouh, Erik Hemberg +1
2020-08-04
Machine Learning · Computer Science
Distributed Hybrid Parallelism for Large Language Models: Comparative Study and System Design Guide
Hossam Amer, Rezaul Karim, Ali Pourranjbar, Weiwei Zhang +2
2026-02-11
Distributed, Parallel, and Cluster Computing · Computer Science
A Hybrid Parallelization Approach for Distributed and Scalable Deep Learning
Samson B. Akintoye, Liangxiu Han, Xin Zhang, Haoming Chen +1
2022-02-08
Machine Learning · Computer Science
Faster learning of deep stacked autoencoders on multi-core systems using synchronized layer-wise pre-training
Anirban Santara, Debapriya Maji, DP Tejas, Pabitra Mitra +1
2016-03-10
Distributed, Parallel, and Cluster Computing · Computer Science
A Comparative Analysis of Distributed Training Strategies for GPT-2
Ishan Patwardhan, Shubham Gandhi, Om Khare, Amit Joshi +1
2024-05-27
Machine Learning · Computer Science
Regularizing Neural Networks via Stochastic Branch Layers
Wonpyo Park, Paul Hongsuck Seo, Bohyung Han, Minsu Cho
2019-10-04
Machine Learning · Statistics
Distributed Training of Deep Neural Networks with Theoretical Analysis: Under SSP Setting
Abhimanu Kumar, Pengtao Xie, Junming Yin, Eric P. Xing
2016-10-04