Computation and Language · Computer Science
Self-Improvement in Multimodal Large Language Models: A Survey
Shijian Deng, Kai Wang, Tianyu Yang, Harsh Singh +1
2025-10-06
Machine Learning · Computer Science
Self-Improving LLM Agents at Test-Time
Emre Can Acikgoz, Cheng Qian, Heng Ji, Dilek Hakkani-Tür +1
2025-10-10
Computation and Language · Computer Science
Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models
Yuda Song, Hanlin Zhang, Carson Eisenach, Sham Kakade +2
2025-02-26
Computation and Language · Computer Science
Test-time Scaling of LLMs: A Survey from A Subproblem Structure Perspective
Zhuoyi Yang, Xu Guo, Tong Zhang, Huijuan Xu +1
2025-11-20
Computation and Language · Computer Science
LLM Inference Enhanced by External Knowledge: A Survey
Yu-Hsuan Lin, Qian-Hui Chen, Yi-Jie Cheng, Jia-Ren Zhang +3
2025-06-02
Computation and Language · Computer Science
Large Language Models Can Self-Improve in Long-context Reasoning
Siheng Li, Cheng Yang, Zesen Cheng, Lemao Liu +3
2024-11-14
Computation and Language · Computer Science
When Can LLMs Actually Correct Their Own Mistakes? A Critical Survey of Self-Correction of LLMs
Ryo Kamoi, Yusen Zhang, Nan Zhang, Jiawei Han +1
2024-12-05
Distributed, Parallel, and Cluster Computing · Computer Science
LLM Inference Serving: Survey of Recent Advances and Opportunities
Baolin Li, Yankai Jiang, Vijay Gadepally, Devesh Tiwari
2024-07-18
Machine Learning · Computer Science
Theoretical Modeling of Large Language Model Self-Improvement Training Dynamics Through Solver-Verifier Gap
Yifan Sun, Yushan Liang, Zhen Zhang, Xin Liu +1
2026-02-10
Machine Learning · Computer Science
Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters
Charlie Snell, Jaehoon Lee, Kelvin Xu, Aviral Kumar
2024-08-07
Computation and Language · Computer Science
Test-time Recursive Thinking: Self-Improvement without External Feedback
Yufan Zhuang, Chandan Singh, Liyuan Liu, Yelong Shen +4
2026-02-04
Computation and Language · Computer Science
Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains
Vighnesh Subramaniam, Yilun Du, Joshua B. Tenenbaum, Antonio Torralba +2
2025-03-04
Computation and Language · Computer Science
A Survey on Efficient Inference for Large Language Models
Zixuan Zhou, Xuefei Ning, Ke Hong, Tianyu Fu +11
2024-07-22
Computation and Language · Computer Science
The Path of Self-Evolving Large Language Models: Achieving Data-Efficient Learning via Intrinsic Feedback
Hangfan Zhang, Siyuan Xu, Zhimeng Guo, Huaisheng Zhu +7
2025-10-06
Computation and Language · Computer Science
On the Intrinsic Self-Correction Capability of LLMs: Uncertainty and Latent Concept
Guangliang Liu, Haitao Mao, Bochuan Cao, Zhiyu Xue +4
2024-11-11
Machine Learning · Computer Science
A Theoretical Understanding of Self-Correction through In-context Alignment
Yifei Wang, Yuyang Wu, Zeming Wei, Stefanie Jegelka +1
2024-11-19
Computation and Language · Computer Science
Efficient Self-Improvement in Multimodal Large Language Models: A Model-Level Judge-Free Approach
Shijian Deng, Wentian Zhao, Yu-Jhe Li, Kun Wan +3
2024-11-28
Computation and Language · Computer Science
Adaptive Inference-Time Compute: LLMs Can Predict if They Can Do Better, Even Mid-Generation
Rohin Manvi, Anikait Singh, Stefano Ermon
2024-10-04
Computation and Language · Computer Science
A Survey on Self-Evolution of Large Language Models
Zhengwei Tao, Ting-En Lin, Xiancai Chen, Hangyu Li +6
2024-06-04
Computation and Language · Computer Science
Self-Improvement of Large Language Models: A Technical Overview and Future Outlook
Haoyan Yang, Mario Xerri, Solha Park, Huajian Zhang +3
2026-03-27
Artificial Intelligence · Computer Science
Bag of Tricks for Inference-time Computation of LLM Reasoning
Fan Liu, Wenshuo Chao, Naiqiang Tan, Hao Liu
2025-02-18
Computation and Language · Computer Science
Pride and Prejudice: LLM Amplifies Self-Bias in Self-Refinement
Wenda Xu, Guanglei Zhu, Xuandong Zhao, Liangming Pan +2
2024-06-19
Computation and Language · Computer Science
LLMRefine: Pinpointing and Refining Large Language Models via Fine-Grained Actionable Feedback
Wenda Xu, Daniel Deutsch, Mara Finkelstein, Juraj Juraska +5
2024-10-28