等等,我们不需要“Wait”!移除思考标记提升推理效率
计算与语言
2025-06-19 v2
摘要
大型推理模型的最新进展实现了复杂的逐步推理,但常引入显著的过度思考,导致冗长且重复的输出,阻碍了效率。在本研究中,我们考察了由“Wait”和“Hmm”等标记发出的显式自我反思对于高级推理是否必要。我们提出了 NoWait,一种简单而有效的方法,通过在推理过程中抑制这些标记来禁用显式自我反思。在涵盖文本、视觉和视频推理任务的十个基准上的广泛实验表明,NoWait 在五个 R1 风格模型系列中将思维链轨迹长度减少了 27%-51%,且未损害模型效用。因此,NoWait 为高效且保持效用的多模态推理提供了一种即插即用的解决方案。
引用
@article{arxiv.2506.08343,
title = {Wait, We Don't Need to "Wait"! Removing Thinking Tokens Improves Reasoning Efficiency},
author = {Chenlong Wang and Yuanning Feng and Dongping Chen and Zhaoyang Chu and Ranjay Krishna and Tianyi Zhou},
journal= {arXiv preprint arXiv:2506.08343},
year = {2025}
}