Artificial Intelligence · Computer Science
Using Reinforcement Learning to Train Large Language Models to Explain Human Decisions
Jian-Qiao Zhu, Hanbo Xie, Dilip Arumugam, Robert C. Wilson +1
2026-02-03
Machine Learning · Computer Science
Reinforcement Learning Fine-tuning of Language Models is Biased Towards More Extractable Features
Diogo Cruz, Edoardo Pona, Alex Holness-Tofts, Elias Schmied +3
2023-11-08
Computation and Language · Computer Science
Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle
Keliang Liu, Dingkang Yang, Ziyun Qian, Weijie Yin +6
2025-09-23
Machine Learning · Computer Science
Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods
Yuji Cao, Huan Zhao, Yuheng Cheng, Ting Shu +6
2024-11-21
Machine Learning · Computer Science
Large Language Model Enhanced Machine Learning Estimators for Classification
Yuhang Wu, Yingfei Wang, Chu Wang, Zeyu Zheng
2024-05-10
Machine Learning · Computer Science
Reinforcement Learning for Aligning Large Language Models Agents with Interactive Environments: Quantifying and Mitigating Prompt Overfitting
Mohamed Salim Aissi, Clement Romac, Thomas Carta, Sylvain Lamprier +4
2025-09-08
Computation and Language · Computer Science
Large Language Models Are Semi-Parametric Reinforcement Learning Agents
Danyang Zhang, Lu Chen, Situo Zhang, Hongshen Xu +2
2023-10-31
Computation and Language · Computer Science
A Survey of Reinforcement Learning for Large Reasoning Models
Kaiyan Zhang, Yuxin Zuo, Bingxiang He, Youbang Sun +35
2025-10-10
Artificial Intelligence · Computer Science
Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models
Guanghao Zhou, Panjia Qiu, Cen Chen, Jie Wang +3
2025-05-22
Machine Learning · Computer Science
Can Large Language Models Learn Formal Logic? A Data-Driven Training and Evaluation Framework
Yuan Xia, Akanksha Atrey, Fadoua Khmaissia, Kedar S. Namjoshi
2025-04-30
Machine Learning · Computer Science
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
Zhenyu Hou, Xin Lv, Rui Lu, Jiajie Zhang +5
2025-06-16
Artificial Intelligence · Computer Science
On the Modeling Capabilities of Large Language Models for Sequential Decision Making
Martin Klissarov, Devon Hjelm, Alexander Toshev, Bogdan Mazoure
2024-10-10
Artificial Intelligence · Computer Science
Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
Zihao Zhou, Bin Hu, Chenyang Zhao, Pu Zhang +1
2024-05-28
Machine Learning · Computer Science
Reinforcement Learning with Promising Tokens for Large Language Models
Jing-Cheng Pang, Liang Lu, Xian Tang, Kun Jiang +3
2026-02-17
Computation and Language · Computer Science
A Principled Framework for Knowledge-enhanced Large Language Model
Saizhuo Wang, Zhihan Liu, Zhaoran Wang, Jian Guo
2023-11-21