Computation and Language · Computer Science
RLVER: Reinforcement Learning with Verifiable Emotion Rewards for Empathetic Agents
Peisong Wang, Ruotian Ma, Bang Zhang, Xingyu Chen +12
2026-03-05
Machine Learning · Computer Science
Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward
Tong Xiao, Xin Xu, Zhenya Huang, Hongyu Gao +3
2026-03-04
Computer Vision and Pattern Recognition · Computer Science
EasyVideoR1: Easier RL for Video Understanding
Chuanyu Qin, Chenxu Yang, Qingyi Si, Naibin Gu +5
2026-04-21
Robotics · Computer Science
ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models
Zirui Song, Guangxian Ouyang, Mingzhe Li, Yuheng Ji +9
2025-05-27
Artificial Intelligence · Computer Science
Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models
Guanghao Zhou, Panjia Qiu, Cen Chen, Jie Wang +3
2025-05-22
Machine Learning · Computer Science
Good Reasoning Makes Good Demonstrations: Implicit Reasoning Quality Supervision via In-Context Reinforcement Learning
Tiehua Mei, Minxuan Lv, Leiyu Pan, Zhenpeng Su +4
2026-03-11
Artificial Intelligence · Computer Science
Extending RLVR to Open-Ended Tasks via Verifiable Multiple-Choice Reformulation
Mengyu Zhang, Siyu Ding, Weichong Yin, Yu Sun +1
2026-02-05
Artificial Intelligence · Computer Science
Reinforcement Learning with Rubric Anchors
Zenan Huang, Yihong Zhuang, Guoshan Lu, Zeyu Qin +17
2025-08-19
Computer Vision and Pattern Recognition · Computer Science
Omni-R1: Reinforcement Learning for Omnimodal Reasoning via Two-System Collaboration
Hao Zhong, Muzhi Zhu, Zongze Du, Zheng Huang +5
2025-05-27
Computer Vision and Pattern Recognition · Computer Science
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
Yiqing Liang, Jielin Qiu, Wenhao Ding, Zuxin Liu +6
2025-06-06
Computation and Language · Computer Science
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
Junjie Zhang, Guozheng Ma, Shunyu Liu, Haoyu Wang +5
2026-03-10
Computer Vision and Pattern Recognition · Computer Science
EchoInk-R1: Exploring Audio-Visual Reasoning in Multimodal LLMs via Reinforcement Learning
Zhenghao Xing, Xiaowei Hu, Chi-Wing Fu, Wenhai Wang +2
2025-06-20
Computer Vision and Pattern Recognition · Computer Science
Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models
Yuhang Han, Yuyang Wu, Zhengbo Jiao, Yiyu Wang +5
2026-03-31
Human-Computer Interaction · Computer Science
AffectGPT-RL: Revealing Roles of Reinforcement Learning in Open-Vocabulary Emotion Recognition
Zheng Lian, Fan Zhang, Lan Chen, Yazhou Zhang +7
2026-05-08
Artificial Intelligence · Computer Science
To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models
Haoqing Wang, Xiang Long, Ziheng Li, Yilong Xu +2
2026-03-12
Machine Learning · Computer Science
DeepVision-103K: A Visually Diverse, Broad-Coverage, and Verifiable Mathematical Dataset for Multimodal Reasoning
Haoxiang Sun, Lizhen Xu, Bing Zhao, Wotao Yin +4
2026-02-20
Computation and Language · Computer Science
Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention
Changyuan Tian, Zhicong Lu, Huaxing Liu, Xiang Wang +6
2026-05-22
Human-Computer Interaction · Computer Science
AffectGPT-R1: Leveraging Reinforcement Learning for Open-Vocabulary Multimodal Emotion Recognition
Zheng Lian, Fan Zhang, Yazhou Zhang, Jianhua Tao +4
2026-02-10
Computer Vision and Pattern Recognition · Computer Science
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
Yi-Fan Zhang, Xingyu Lu, Xiao Hu, Chaoyou Fu +12
2025-05-12
Machine Learning · Computer Science
Outcome-based Reinforcement Learning to Predict the Future
Benjamin Turtel, Danny Franklin, Kris Skotheim, Luke Hewitt +1
2025-12-02
Artificial Intelligence · Computer Science
Emotion-Coherent Reasoning for Multimodal LLMs via Emotional Rationale Verifier
Hyeongseop Rha, Jeong Hun Yeo, Yeonju Kim, Yong Man Ro
2026-01-06
Machine Learning · Computer Science
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
Shiting Huang, Zecheng Li, Yu Zeng, Qingnan Ren +6
2026-02-12
Machine Learning · Computer Science
Efficient Reinforcement Learning for Large Language Models with Intrinsic Exploration
Yan Sun, Jia Guo, Stanley Kok, Zihao Wang +2
2026-02-20