Computation and Language · Computer Science
Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models
Changyu Chen, Xiting Wang, Ting-En Lin, Ang Lv +5
2024-07-12
Machine Learning · Computer Science
Good Learners Think Their Thinking: Generative PRM Makes Large Reasoning Model More Efficient Math Learner
Tao He, Rongchuan Mu, Lizi Liao, Yixin Cao +2
2025-08-01
Artificial Intelligence · Computer Science
Self-rewarding correction for mathematical reasoning
Wei Xiong, Hanning Zhang, Chenlu Ye, Lichang Chen +2
2025-02-28
Artificial Intelligence · Computer Science
Improving reasoning at inference time via uncertainty minimisation
Nicolas Legrand, Kenneth Enevoldsen, Márton Kardos, Kristoffer Nielbo
2026-03-10
Computation and Language · Computer Science
In-Token Rationality Optimization: Towards Accurate and Concise LLM Reasoning via Self-Feedback
Mingye Zhu, Yi Liu, Zheren Fu, Quan Wang +1
2025-11-14
Computation and Language · Computer Science
Inference-Time Rethinking with Latent Thought Vectors for Math Reasoning
Deqian Kong, Minglu Zhao, Aoyang Qin, Bo Pang +9
2026-02-09
Artificial Intelligence · Computer Science
Efficient Reinforcement Learning with Semantic and Token Entropy for LLM Reasoning
Hongye Cao, Zhixin Bai, Ziyue Peng, Boyan Wang +4
2026-01-19
Computation and Language · Computer Science
Effective Reasoning Chains Reduce Intrinsic Dimensionality
Archiki Prasad, Mandar Joshi, Kenton Lee, Mohit Bansal +1
2026-02-11
Computation and Language · Computer Science
Iterative Reasoning Preference Optimization
Richard Yuanzhe Pang, Weizhe Yuan, Kyunghyun Cho, He He +2
2024-06-27
Artificial Intelligence · Computer Science
EntroCut: Entropy-Guided Adaptive Truncation for Efficient Chain-of-Thought Reasoning in Small-scale Large Reasoning Models
Hongxi Yan, Qingjie Liu, Yunhong Wang
2026-02-02
Computation and Language · Computer Science
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens
Xixian Yong, Xiao Zhou, Yingying Zhang, Jinlin Li +2
2025-05-27
Machine Learning · Computer Science
Right Question is Already Half the Answer: Fully Unsupervised LLM Reasoning Incentivization
Qingyang Zhang, Haitao Wu, Changqing Zhang, Peilin Zhao +1
2025-05-20
Computation and Language · Computer Science
Think Twice Before You Write -- an Entropy-based Decoding Strategy to Enhance LLM Reasoning
Jiashu He, Meizhu Liu, Olaitan P Olaleye, Amit Agarwal +8
2026-04-02
Computation and Language · Computer Science
Controlling Thinking Speed in Reasoning Models
Zhengkai Lin, Zhihang Fu, Ze Chen, Chao Chen +5
2025-10-31
Computation and Language · Computer Science
Let LRMs Break Free from Overthinking via Self-Braking Tuning
Haoran Zhao, Yuchen Yan, Yongliang Shen, Haolei Xu +6
2025-10-31
Artificial Intelligence · Computer Science
SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning
Zheng Li, Qingxiu Dong, Jingyuan Ma, Di Zhang +2
2026-04-20
Computation and Language · Computer Science
Self-Training Elicits Concise Reasoning in Large Language Models
Tergel Munkhbat, Namgyu Ho, Seo Hyun Kim, Yongjin Yang +2
2025-06-11
Artificial Intelligence · Computer Science
Conformal Thinking: Risk Control for Reasoning on a Compute Budget
Xi Wang, Anushri Suresh, Alvin Zhang, Rishi More +5
2026-05-15
Computation and Language · Computer Science
Think Natively: Unlocking Multilingual Reasoning with Consistency-Enhanced Reinforcement Learning
Xue Zhang, Yunlong Liang, Fandong Meng, Songming Zhang +4
2026-01-09