Machine Learning · Computer Science
Language Reward Modulation for Pretraining Reinforcement Learning
Ademi Adeniji, Amber Xie, Carmelo Sferrazza, Younggyo Seo +2
2023-08-24
Robotics · Computer Science
Fuzzy Logic Theory-based Adaptive Reward Shaping for Robust Reinforcement Learning (FARS)
Hürkan Şahin, Van Huyen Dang, Erdi Sayar, Alper Yegenoglu +1
2026-04-20
Robotics · Computer Science
RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback
Yufei Wang, Zhanyi Sun, Jesse Zhang, Zhou Xian +3
2024-06-18
Machine Learning · Computer Science
Code as Reward: Empowering Reinforcement Learning with VLMs
David Venuto, Sami Nur Islam, Martin Klissarov, Doina Precup +2
2024-02-08
Robotics · Computer Science
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
Yanru Wu, Weiduo Yuan, Ang Qi, Vitor Guizilini +2
2026-03-24
Computation and Language · Computer Science
Beyond Sparse Rewards: Enhancing Reinforcement Learning with Language Model Critique in Text Generation
Meng Cao, Lei Shu, Lei Yu, Yun Zhu +3
2024-02-20
Robotics · Computer Science
Improving Vision-Language-Action Model with Online Reinforcement Learning
Yanjiang Guo, Jianke Zhang, Xiaoyu Chen, Xiang Ji +3
2025-01-29
Machine Learning · Computer Science
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
Juan Rocamonde, Victoriano Montesinos, Elvis Nava, Ethan Perez +1
2024-03-15
Robotics · Computer Science
VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving
Zilin Huang, Zihao Sheng, Yansong Qu, Junwei You +1
2024-12-23
Artificial Intelligence · Computer Science
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
Anukriti Singh, Amisha Bhaskar, Peihong Yu, Souradip Chakraborty +3
2025-03-19
Robotics · Computer Science
MARVL: Multi-Stage Guidance for Robotic Manipulation via Vision-Language Models
Xunlan Zhou, Xuanlin Chen, Shaowei Zhang, ShengHua Wan +3
2026-05-08
Machine Learning · Computer Science
Teaching RL Agents to Act Better: VLM as Action Advisor for Online Reinforcement Learning
Xiefeng Wu, Jing Zhao, Shu Zhang, Mingyu Hu
2025-09-26
Computer Vision and Pattern Recognition · Computer Science
Finite Difference Flow Optimization for RL Post-Training of Text-to-Image Models
David McAllister, Miika Aittala, Tero Karras, Janne Hellsten +3
2026-03-16
Machine Learning · Computer Science
Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
Tung Minh Luu, Younghwan Lee, Donghoon Lee, Sunho Kim +2
2025-06-17
Computer Vision and Pattern Recognition · Computer Science
Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards
Zijing Hu, Fengda Zhang, Long Chen, Kun Kuang +5
2025-03-28
Machine Learning · Computer Science
ConfClip: Confidence-Weighted and Clipped Reward for Reinforcement Learning in LLMs
Bonan Zhang, Zhongqi Chen, Bowen Song, Qinya Li +2
2025-09-23
Robotics · Computer Science
VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
Hengtao Li, Pengxiang Ding, Runze Suo, Yihao Wang +7
2025-10-02
Computation and Language · Computer Science
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
Subhojyoti Mukherjee, Viet Dac Lai, Raghavendra Addanki, Ryan Rossi +5
2026-02-17
Robotics · Computer Science
VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning
Guanxing Lu, Wenkai Guo, Chubin Zhang, Yuheng Zhou +4
2025-05-27
Software Engineering · Computer Science
Fuzzy Logic Guided Reward Function Variation: An Oracle for Testing Reinforcement Learning Programs
Shiyu Zhang, Haoyang Song, Qixin Wang, Yu Pei
2024-07-01
Artificial Intelligence · Computer Science
Words as Beacons: Guiding RL Agents with High-Level Language Prompts
Unai Ruiz-Gonzalez, Alain Andres, Pedro G. Bascoy, Javier Del Ser
2024-10-14
Artificial Intelligence · Computer Science
VIRAL: Vision-grounded Integration for Reward design And Learning
Valentin Cuzin-Rambaud, Emilien Komlenovic, Alexandre Faure, Bruno Yun
2025-10-29
Computer Vision and Pattern Recognition · Computer Science
PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning
Yizhen Zhang, Yang Ding, Shuoshuo Zhang, Xinchen Zhang +8
2025-06-19
Cryptography and Security · Computer Science
R1-Fuzz: Specializing Language Models for Textual Fuzzing via Reinforcement Learning
Jiayi Lin, Liangcai Su, Junzhe Li, Chenxiong Qian
2025-09-26