Computer Vision and Pattern Recognition · Computer Science
Co-Reinforcement Learning for Unified Multimodal Understanding and Generation
Jingjing Jiang, Chongjie Si, Jun Luo, Hanwang Zhang +1
2025-11-21
Artificial Intelligence · Computer Science
Zero Reinforcement Learning Towards General Domains
Yuyuan Zeng, Yufei Huang, Can Xu, Qingfeng Sun +4
2025-10-30
Machine Learning · Computer Science
A Unified Framework for Zero-Shot Reinforcement Learning
Jacopo Di Ventura, Jan Felix Kleuker, Aske Plaat, Thomas Moerland
2026-03-10
Computer Vision and Pattern Recognition · Computer Science
Unified Reinforcement and Imitation Learning for Vision-Language Models
Byung-Kwan Lee, Ryo Hachiuma, Yong Man Ro, Yu-Chiang Frank Wang +1
2025-10-23
Computer Vision and Pattern Recognition · Computer Science
UniGen-1.5: Enhancing Image Generation and Editing through Reward Unification in Reinforcement Learning
Rui Tian, Mingfei Gao, Haiming Gang, Jiasen Lu +4
2025-11-19
Artificial Intelligence · Computer Science
SuperRL: Reinforcement Learning with Supervision to Boost Language Model Reasoning
Yihao Liu, Shuocheng Li, Lang Cao, Yuhang Xie +5
2025-08-11
Artificial Intelligence · Computer Science
Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models
Guanghao Zhou, Panjia Qiu, Cen Chen, Jie Wang +3
2025-05-22
Machine Learning · Computer Science
OpenRL: A Unified Reinforcement Learning Framework
Shiyu Huang, Wentse Chen, Yiwen Sun, Fuqing Bie +1
2023-12-29
Robotics · Computer Science
Unity RL Playground: A Versatile Reinforcement Learning Framework for Mobile Robots
Linqi Ye, Rankun Li, Xiaowen Hu, Jiayi Li +3
2025-03-10
Machine Learning · Computer Science
A Unified Framework for Alternating Offline Model Training and Policy Learning
Shentao Yang, Shujian Zhang, Yihao Feng, Mingyuan Zhou
2022-10-13
Information Retrieval · Computer Science
High Fidelity Textual User Representation over Heterogeneous Sources via Reinforcement Learning
Rajat Arora, Ye Tao, Jianqiang Shen, Ping Liu +6
2026-02-10
Machine Learning · Computer Science
AcceRL: A Distributed Asynchronous Reinforcement Learning and World Model Framework for Vision-Language-Action Models
Chengxuan Lu, Shukuan Wang, Yanjie Li, Wei Liu +5
2026-03-23
Machine Learning · Computer Science
Diffusion Models for Reinforcement Learning: Foundations, Taxonomy, and Development
Changfu Xu, Jianxiong Guo, Yuzhu Liang, Haiyang Huang +6
2025-10-15
Artificial Intelligence · Computer Science
Omni-R1: Towards the Unified Generative Paradigm for Multimodal Reasoning
Dongjie Cheng, Yongqi Li, Zhixin Ma, Hongru Cai +4
2026-04-21
Computer Vision and Pattern Recognition · Computer Science
Integrating Reinforcement Learning with Visual Generative Models: Foundations and Advances
Yuanzhi Liang, Yijie Fang, Ke Hao, Rui Li +3
2026-01-21
Artificial Intelligence · Computer Science
Training Emergent Joint Associations: A Reinforcement Learning Approach to Creative Thinking in Language Models
Mukul Singh, Ananya Singha, Aishni Parab, Pronita Mehrotra +1
2025-11-25
Computer Vision and Pattern Recognition · Computer Science
UniFL: Improve Latent Diffusion Model via Unified Feedback Learning
Jiacheng Zhang, Jie Wu, Yuxi Ren, Xin Xia +8
2024-11-27
Artificial Intelligence · Computer Science
MADQRL: Distributed Quantum Reinforcement Learning Framework for Multi-Agent Environments
Abhishek Sawaika, Samuel Yen-Chi Chen, Udaya Parampalli, Rajkumar Buyya
2026-04-14
Computer Vision and Pattern Recognition · Computer Science
UniDoc-RL: Coarse-to-Fine Visual RAG with Hierarchical Actions and Dense Rewards
Jun Wang, Shuo Tan, Zelong Sun, Tiancheng Gu +4
2026-04-20
Machine Learning · Computer Science
Reinforcement Learning with Discrete Diffusion Policies for Combinatorial Action Spaces
Haitong Ma, Ofir Nabati, Aviv Rosenberg, Bo Dai +6
2026-05-21
Machine Learning · Computer Science
Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning
Shangding Gu, Laixi Shi, Muning Wen, Ming Jin +4
2025-02-28
Machine Learning · Computer Science
Towards General-Purpose Model-Free Reinforcement Learning
Scott Fujimoto, Pierluca D'Oro, Amy Zhang, Yuandong Tian +1
2025-01-28