Machine Learning · Computer Science
LocMoE: A Low-Overhead MoE for Large Language Model Training
Jing Li, Zhijie Sun, Xuan He, Li Zeng +5
2024-05-24
Computation and Language · Computer Science
MoE-LPR: Multilingual Extension of Large Language Models through Mixture-of-Experts with Language Priors Routing
Hao Zhou, Zhijun Wang, Shujian Huang, Xin Huang +5
2024-08-22
Machine Learning · Computer Science
Least-Loaded Expert Parallelism: Load Balancing An Imbalanced Mixture-of-Experts
Xuan-Phi Nguyen, Shrey Pandit, Austin Xu, Caiming Xiong +1
2026-01-27
Computation and Language · Computer Science
Multilingual Routing in Mixture-of-Experts
Lucas Bandarkar, Chenyuan Yang, Mohsen Fayyaz, Junlin Hu +1
2026-02-19
Computation and Language · Computer Science
ReXMoE: Reusing Experts with Minimal Overhead in Mixture-of-Experts
Zheyue Tan, Zhiyuan Li, Tao Yuan, Dong Zhou +12
2025-10-21
Multimedia · Computer Science
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
Qiong Wu, Zhaoxi Ke, Yiyi Zhou, Xiaoshuai Sun +1
2025-02-13
Computation and Language · Computer Science
Advancing Expert Specialization for Better MoE
Hongcan Guo, Haolang Lu, Guoshun Nan, Bolun Chu +7
2026-01-27
Machine Learning · Computer Science
Opportunistic Expert Activation: Batch-Aware Expert Routing for Faster Decode Without Retraining
Costin-Andrei Oncescu, Qingyang Wu, Wai Tong Chung, Robert Wu +4
2025-11-05
Robotics · Computer Science
LAR-MoE: Latent-Aligned Routing for Mixture of Experts in Robotic Imitation Learning
Ariel Rodriguez, Chenpan Li, Lorenzo Mazza, Rayan Younis +4
2026-03-10
Machine Learning · Computer Science
MoLAE: Mixture of Latent Experts for Parameter-Efficient Language Models
Zehua Liu, Han Wu, Ruifeng She, Xiaojin Fu +3
2025-05-27
Artificial Intelligence · Computer Science
Unifying Mixture of Experts and Multi-Head Latent Attention for Efficient Language Models
Sushant Mehta, Raj Dandekar, Rajat Dandekar, Sreedath Panat
2025-08-05
Networking and Internet Architecture · Computer Science
Mixture of Experts for Network Optimization: A Large Language Model-enabled Approach
Hongyang Du, Guangyuan Liu, Yijing Lin, Dusit Niyato +3
2024-02-16
Machine Learning · Computer Science
A Survey on Mixture of Experts in Large Language Models
Weilin Cai, Juyong Jiang, Fan Wang, Jing Tang +2
2025-04-10
Computation and Language · Computer Science
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
Xudong Lu, Qi Liu, Yuhui Xu, Aojun Zhou +4
2024-05-31
Computation and Language · Computer Science
Pre-Attention Expert Prediction and Prefetching for Mixture-of-Experts Large Language Models
Shien Zhu, Samuel Bohl, Robin Oester, Gustavo Alonso
2025-11-17
Computation and Language · Computer Science
Diversifying the Expert Knowledge for Task-Agnostic Pruning in Sparse Mixture-of-Experts
Zeliang Zhang, Xiaodong Liu, Hao Cheng, Chenliang Xu +1
2025-06-10
Machine Learning · Computer Science
MoE Routing Testbed: Studying Expert Specialization and Routing Behavior at Small Scale
Tobias Falke, Nicolas Anastassacos, Samson Tan, Chankrisna Richy Meas +5
2026-04-09
Distributed, Parallel, and Cluster Computing · Computer Science
LAER-MoE: Load-Adaptive Expert Re-layout for Efficient Mixture-of-Experts Training
Xinyi Liu, Yujie Wang, Fangcheng Fu, Xuefeng Xiao +3
2026-02-13
Machine Learning · Computer Science
Not All Models Suit Expert Offloading: On Local Routing Consistency of Mixture-of-Expert Models
Jingcong Liang, Siyuan Wang, Miren Tian, Yitong Li +2
2026-03-03
Machine Learning · Computer Science
Mixture Compressor for Mixture-of-Experts LLMs Gains More
Wei Huang, Yue Liao, Jianhui Liu, Ruifei He +5
2025-02-25
Machine Learning · Computer Science
T-REX: Mixture-of-Rank-One-Experts with Semantic-aware Intuition for Multi-task Large Language Model Finetuning
Rongyu Zhang, Yijiang Liu, Huanrui Yang, Shenli Zheng +4
2025-05-28