Artificial Intelligence · Computer Science
Training Emergent Joint Associations: A Reinforcement Learning Approach to Creative Thinking in Language Models
Mukul Singh, Ananya Singha, Aishni Parab, Pronita Mehrotra +1
2025-11-25
Computation and Language · Computer Science
ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models
Mingjie Liu, Shizhe Diao, Ximing Lu, Jian Hu +4
2025-06-02
Machine Learning · Computer Science
Simplifying Model-based RL: Learning Representations, Latent-space Models, and Policies with One Objective
Raj Ghugare, Homanga Bharadhwaj, Benjamin Eysenbach, Sergey Levine +1
2023-06-27
Computation and Language · Computer Science
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
Charlie Zhang, Graham Neubig, Xiang Yue
2025-12-09
Artificial Intelligence · Computer Science
ARCLE: The Abstraction and Reasoning Corpus Learning Environment for Reinforcement Learning
Hosung Lee, Sejin Kim, Seungpil Lee, Sanha Hwang +3
2024-07-31
Computation and Language · Computer Science
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
DeepSeek-AI, Daya Guo, Dejian Yang, Haowei Zhang +196
2026-01-06
Machine Learning · Computer Science
You Need Reasoning to Learn Reasoning: The Limitations of Label-Free RL in Weak Base Models
Shuvendu Roy, Hossein Hajimirsadeghi, Mengyao Zhai, Golnoosh Samei
2025-11-10
Computation and Language · Computer Science
Towards Effective Code-Integrated Reasoning
Fei Bai, Yingqian Min, Beichen Zhang, Zhipeng Chen +5
2025-06-02
Machine Learning · Computer Science
Contrastive Learning as Goal-Conditioned Reinforcement Learning
Benjamin Eysenbach, Tianjun Zhang, Ruslan Salakhutdinov, Sergey Levine
2023-02-21
Artificial Intelligence · Computer Science
In-Context Analogical Reasoning with Pre-Trained Language Models
Xiaoyang Hu, Shane Storks, Richard L. Lewis, Joyce Chai
2023-06-06
Machine Learning · Computer Science
Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation
Pei-Chi Pan, Yingbin Liang, Sen Lin
2026-02-11
Artificial Intelligence · Computer Science
Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models
Guanghao Zhou, Panjia Qiu, Cen Chen, Jie Wang +3
2025-05-22
Artificial Intelligence · Computer Science
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Huatong Song, Jinhao Jiang, Yingqian Min, Jie Chen +4
2025-03-19
Machine Learning · Computer Science
SOLAR: Deep Structured Representations for Model-Based Reinforcement Learning
Marvin Zhang, Sharad Vikram, Laura Smith, Pieter Abbeel +2
2019-06-25
Machine Learning · Computer Science
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
Isha Puri, Mehul Damani, Idan Shenfeld, Marzyeh Ghassemi +2
2026-03-27
Machine Learning · Computer Science
Local Search for Policy Iteration in Continuous Control
Jost Tobias Springenberg, Nicolas Heess, Daniel Mankowitz, Josh Merel +9
2020-10-13
Machine Learning · Computer Science
Model-Based Reinforcement Learning via Latent-Space Collocation
Oleh Rybkin, Chuning Zhu, Anusha Nagabandi, Kostas Daniilidis +2
2021-08-10
Machine Learning · Computer Science
Simplified Temporal Consistency Reinforcement Learning
Yi Zhao, Wenshuai Zhao, Rinu Boney, Juho Kannala +1
2023-06-19
Computer Vision and Pattern Recognition · Computer Science
VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model
Haozhan Shen, Peng Liu, Jingcheng Li, Chunxin Fang +8
2025-04-15
Computation and Language · Computer Science
Parallel-R1: Towards Parallel Thinking via Reinforcement Learning
Tong Zheng, Hongming Zhang, Wenhao Yu, Xiaoyang Wang +6
2025-09-15