Computation and Language · Computer Science
Investigating Structural Pruning and Recovery Techniques for Compressing Multimodal Large Language Models: An Empirical Study
Yiran Huang, Lukas Thede, Massimiliano Mancini, Wenjia Xu +1
2025-07-29
Computation and Language · Computer Science
When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Models
Weilan Wang, Yu Mao, Dongdong Tang, Hongchao Du +2
2025-02-24
Computer Vision and Pattern Recognition · Computer Science
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
Xinhao Wang, Zhonyu Xia, Zhiwei Lin, Zhe Li +1
2026-04-06
Computation and Language · Computer Science
Structural Pruning of Large Vision Language Models: A Comprehensive Study on Pruning Dynamics, Recovery, and Data Efficiency
Yiran Huang, Lukas Thede, Massimiliano Mancini, Wenjia Xu +1
2026-04-28
Machine Learning · Computer Science
Reassessing Layer Pruning in LLMs: New Insights and Methods
Yao Lu, Hao Cheng, Yujie Fang, Zeyu Wang +5
2024-11-26
Computation and Language · Computer Science
OpenBA-V2: Reaching 77.3% High Compression Ratio with Fast Multi-Stage Pruning
Dan Qiao, Yi Su, Pinzheng Wang, Jing Ye +17
2024-05-10
Computer Vision and Pattern Recognition · Computer Science
Towards Understanding Best Practices for Quantization of Vision-Language Models
Gautom Das, Vincent La, Ethan Lau, Abhinav Shrivastava +1
2026-01-22
Computation and Language · Computer Science
The Cost of Compression: Investigating the Impact of Compression on Parametric Knowledge in Language Models
Satya Sai Srinath Namburi, Makesh Sreedhar, Srinath Srinivasan, Frederic Sala
2023-12-05
Computation and Language · Computer Science
Aggressive Post-Training Compression on Extremely Large Language Models
Zining Zhang, Yao Chen, Bingsheng He, Zhenjie Zhang
2024-10-01
Machine Learning · Computer Science
Comprehensive Study on Performance Evaluation and Optimization of Model Compression: Bridging Traditional Deep Learning and Large Language Models
Aayush Saxena, Arit Kumar Bishwas, Ayush Ashok Mishra, Ryan Armstrong
2024-07-24
Computation and Language · Computer Science
Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations
Bowen Shen, Zheng Lin, Daren Zha, Wei Liu +3
2024-07-09
Computation and Language · Computer Science
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
Deyuan Liu, Zhanyue Qin, Hairu Wang, Zhao Yang +11
2025-05-20
Machine Learning · Computer Science
SlimLLM: Accurate Structured Pruning for Large Language Models
Jialong Guo, Xinghao Chen, Yehui Tang, Yunhe Wang
2025-05-30
Machine Learning · Computer Science
Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods
Bo-Kyeong Kim, Geonmin Kim, Tae-Ho Kim, Thibault Castells +3
2024-06-25
Machine Learning · Computer Science
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models
Changhai Zhou, Yuhua Zhou, Shijie Han, Qian Qiao +1
2024-12-17
Computation and Language · Computer Science
Decoding Compressed Trust: Scrutinizing the Trustworthiness of Efficient LLMs Under Compression
Junyuan Hong, Jinhao Duan, Chenhui Zhang, Zhangheng Li +11
2024-06-05
Artificial Intelligence · Computer Science
Mechanistically Interpreting Compression in Vision-Language Models
Veeraraju Elluru, Arth Singh, Roberto Aguero, Ajay Agarwal +2
2026-03-27
Computation and Language · Computer Science
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
Guinan Su, Li Shen, Lu Yin, Shiwei Liu +2
2025-06-26
Computation and Language · Computer Science
Pruning Large Language Models by Identifying and Preserving Functional Networks
Yiheng Liu, Junhao Ning, Sichen Xia, Xiaohui Gao +4
2025-08-08
Machine Learning · Computer Science
LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning
Mingyang Zhang, Hao Chen, Chunhua Shen, Zhen Yang +3
2024-08-08