Computation and Language · Computer Science
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
Runming Yang, Taiqiang Wu, Jiahao Wang, Pengfei Hu +3
2025-02-26
Computation and Language · Computer Science
Mixed Distillation Helps Smaller Language Model Better Reasoning
Chenglin Li, Qianglong Chen, Liangyue Li, Caiyu Wang +3
2024-02-27
Computation and Language · Computer Science
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
Xunyu Zhu, Jian Li, Can Ma, Weiping Wang
2024-11-25
Machine Learning · Computer Science
Knowledge Distillation Using Frontier Open-source LLMs: Generalizability and the Role of Synthetic Data
Anup Shirgaonkar, Nikhil Pandey, Nazmiye Ceren Abay, Tolga Aktas +1
2024-10-25
Computation and Language · Computer Science
Knowledge-Augmented Reasoning Distillation for Small Language Models in Knowledge-Intensive Tasks
Minki Kang, Seanie Lee, Jinheon Baek, Kenji Kawaguchi +1
2023-10-31
Computation and Language · Computer Science
Can Large Models Teach Student Models to Solve Mathematical Problems Like Human Beings? A Reasoning Distillation Method via Multi-LoRA Interaction
Xinhe Li, Jiajun Liu, Peng Wang
2025-08-19
Computation and Language · Computer Science
Evolving Knowledge Distillation with Large Language Models and Active Learning
Chengyuan Liu, Yangyang Kang, Fubang Zhao, Kun Kuang +3
2024-03-12
Computation and Language · Computer Science
Enhancing Knowledge Distillation for LLMs with Response-Priming Prompting
Vijay Goyal, Mustafa Khan, Aprameya Tirupati, Harveer Saini +2
2024-12-25
Artificial Intelligence · Computer Science
Logic Distillation: Learning from Code Function by Function for Decision-making Tasks
Dong Chen, Shilin Zhang, Fei Gao, Yueting Zhuang +3
2025-11-11
Computation and Language · Computer Science
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
Chuanpeng Yang, Wang Lu, Yao Zhu, Yidong Wang +4
2024-07-03
Machine Learning · Computer Science
Efficient Reasoning on the Edge
Yelysei Bondarenko, Thomas Hehn, Rob Hesselink, Romain Lepert +14
2026-03-18
Computation and Language · Computer Science
MiniLLM: On-Policy Distillation of Large Language Models
Yuxian Gu, Li Dong, Furu Wei, Minlie Huang
2026-02-03
Machine Learning · Statistics
Demystifying Low-Rank Knowledge Distillation in Large Language Models: Convergence, Generalization, and Information-Theoretic Guarantees
Alberlucia Rafael Soarez, Daniel Kim, Mariana Costa, Alejandro Torre
2026-03-25
Computation and Language · Computer Science
Flipping Knowledge Distillation: Leveraging Small Models' Expertise to Enhance LLMs in Text Matching
Mingzhe Li, Jing Xiang, Qishen Zhang, Kaiyang Wan +1
2025-07-09
Computation and Language · Computer Science
Effective Distillation of Table-based Reasoning Ability from LLMs
Bohao Yang, Chen Tang, Kun Zhao, Chenghao Xiao +1
2024-03-26
Databases · Computer Science
DistillER: Knowledge Distillation in Entity Resolution with Large Language Models
Alexandros Zeakis, George Papadakis, Dimitrios Skoutas, Manolis Koubarakis
2026-02-06
Computation and Language · Computer Science
LLAVADI: What Matters For Multimodal Large Language Models Distillation
Shilin Xu, Xiangtai Li, Haobo Yuan, Lu Qi +2
2024-07-30
Computation and Language · Computer Science
ELAD: Explanation-Guided Large Language Models Active Distillation
Yifei Zhang, Bo Pan, Chen Ling, Yuntong Hu +1
2024-11-21
Computation and Language · Computer Science
How Much Knowledge Can You Pack into a LoRA Adapter without Harming LLM?
Sergey Pletenev, Maria Marina, Daniil Moskovskiy, Vasily Konovalov +3
2025-03-25
Computer Vision and Pattern Recognition · Computer Science
LLaVA-MoD: Making LLaVA Tiny via MoE Knowledge Distillation
Fangxun Shu, Yue Liao, Le Zhuo, Chenning Xu +13
2024-10-24
Computation and Language · Computer Science
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
Yijun Tian, Yikun Han, Xiusi Chen, Wei Wang +1
2024-11-26
Computation and Language · Computer Science
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
Rambod Azimi, Rishav Rishav, Marek Teichmann, Samira Ebrahimi Kahou
2024-10-29