Machine Learning · Computer Science
Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning
Hanyang Zhao, Haoxian Chen, Ji Zhang, David D. Yao +1
2024-09-16
Machine Learning · Computer Science
Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review
Masatoshi Uehara, Yulai Zhao, Tommaso Biancalani, Sergey Levine
2024-07-19
Computer Vision and Pattern Recognition · Computer Science
Alignment and Safety of Diffusion Models via Reinforcement Learning and Reward Modeling: A Survey
Preeti Lamba, Kiran Ravish, Ankita Kushwaha, Pawan Kumar
2026-05-19
Artificial Intelligence · Computer Science
Inference-Time Alignment in Diffusion Models with Reward-Guided Generation: Tutorial and Review
Masatoshi Uehara, Yulai Zhao, Chenyu Wang, Xiner Li +3
2025-01-22
Artificial Intelligence · Computer Science
Navigating Noisy Feedback: Enhancing Reinforcement Learning with Error-Prone Language Models
Muhan Lin, Shuyang Shi, Yue Guo, Behdad Chalaki +5
2024-10-24
Machine Learning · Computer Science
Diffusion Guidance Is a Controllable Policy Improvement Operator
Kevin Frans, Seohong Park, Pieter Abbeel, Sergey Levine
2025-05-30
Machine Learning · Computer Science
Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance
Luozhijie Jin, Zijie Qiu, Jie Liu, Zijie Diao +4
2025-08-29
Machine Learning · Computer Science
Reinforcement Learning from Multi-level and Episodic Human Feedback
Muhammad Qasim Elahi, Somtochukwu Oguchienti, Maheed H. Ahmed, Mahsa Ghasemi
2025-04-29
Artificial Intelligence · Computer Science
Leveraging Human Guidance for Deep Reinforcement Learning Tasks
Ruohan Zhang, Faraz Torabi, Lin Guan, Dana H. Ballard +1
2019-09-24
Machine Learning · Computer Science
Expanding the Capabilities of Reinforcement Learning via Text Feedback
Yuda Song, Lili Chen, Fahim Tajwar, Remi Munos +4
2026-02-12
Machine Learning · Computer Science
Reward Models in Deep Reinforcement Learning: A Survey
Rui Yu, Shenghua Wan, Yucen Wang, Chen-Xiao Gao +3
2025-06-19
Machine Learning · Computer Science
Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
Hanyang Zhao, Haoxian Chen, Ji Zhang, David D. Yao +1
2025-08-25
Machine Learning · Computer Science
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
Jeongjae Lee, Jinho Chang, Jeongsol Kim, Jong Chul Ye
2026-05-08
Computation and Language · Computer Science
Can Diffusion Model Achieve Better Performance in Text Generation? Bridging the Gap between Training and Inference!
Zecheng Tang, Pinzheng Wang, Keyan Zhou, Juntao Li +2
2023-05-09
Machine Learning · Computer Science
Diffusion Models for Reinforcement Learning: A Survey
Zhengbang Zhu, Hanye Zhao, Haoran He, Yichao Zhong +4
2024-02-26
Information Retrieval · Computer Science
Fine-Tuning Diffusion-Based Recommender Systems via Reinforcement Learning with Reward Function Optimization
Yu Hou, Hua Li, Ha Young Kim, Won-Yong Shin
2025-11-11
Computer Vision and Pattern Recognition · Computer Science
Finite Difference Flow Optimization for RL Post-Training of Text-to-Image Models
David McAllister, Miika Aittala, Tero Karras, Janne Hellsten +3
2026-03-16
Robotics · Computer Science
CHARM: Considering Human Attributes for Reinforcement Modeling
Qidi Fang, Hang Yu, Shijie Fang, Jindan Huang +3
2025-12-30
Machine Learning · Computer Science
Mapping out the Space of Human Feedback for Reinforcement Learning: A Conceptual Framework
Yannick Metz, David Lindner, Raphaël Baur, Mennatallah El-Assady
2025-02-21
Machine Learning · Computer Science
Planning with Diffusion for Flexible Behavior Synthesis
Michael Janner, Yilun Du, Joshua B. Tenenbaum, Sergey Levine
2022-12-22