Machine Learning · Computer Science
Estimation Error Correction in Deep Reinforcement Learning for Deterministic Actor-Critic Methods
Baturay Saglam, Enes Duran, Dogan C. Cicek, Furkan B. Mutlu +1
2021-12-28
Machine Learning · Computer Science
Error Controlled Actor-Critic
Xingen Gao, Fei Chao, Changle Zhou, Zhen Ge +4
2021-09-08
Machine Learning · Computer Science
Balancing Value Underestimation and Overestimation with Realistic Actor-Critic
Sicen Li, Qinyun Tang, Yiming Pang, Xinmeng Ma +1
2022-10-27
Machine Learning · Computer Science
Parameter-free Reduction of the Estimation Bias in Deep Reinforcement Learning for Deterministic Policy Gradients
Baturay Saglam, Furkan Burak Mutlu, Dogan Can Cicek, Suleyman Serdar Kozat
2022-05-20
Machine Learning · Computer Science
Mitigating Estimation Bias with Representation Learning in TD Error-Driven Regularization
Haohui Chen, Zhiyong Chen, Aoxiang Liu, Wentuo Fang
2025-11-21
Machine Learning · Computer Science
Reducing Overestimation Bias in Multi-Agent Domains Using Double Centralized Critics
Johannes Ackermann, Volker Gabler, Takayuki Osa, Masashi Sugiyama
2019-12-03
Machine Learning · Computer Science
Efficient Continuous Control with Double Actors and Regularized Critics
Jiafei Lyu, Xiaoteng Ma, Jiangpeng Yan, Xiu Li
2021-06-08
Machine Learning · Computer Science
Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor
Tuomas Haarnoja, Aurick Zhou, Pieter Abbeel, Sergey Levine
2018-08-10
Machine Learning · Computer Science
Automating Control of Overestimation Bias for Reinforcement Learning
Arsenii Kuznetsov, Alexander Grishin, Artem Tsypin, Arsenii Ashukha +2
2022-02-01
Machine Learning · Computer Science
ADDQ: Adaptive Distributional Double Q-Learning
Leif Döring, Benedikt Wille, Maximilian Birr, Mihail Bîrsan +1
2025-06-26
Machine Learning · Computer Science
Exploiting Estimation Bias in Clipped Double Q-Learning for Continous Control Reinforcement Learning Tasks
Niccolò Turcato, Alberto Sinigaglia, Alberto Dalla Libera, Ruggero Carli +1
2024-10-14
Machine Learning · Computer Science
Balanced Q-learning: Combining the Influence of Optimistic and Pessimistic Targets
Thommen George Karimpanal, Hung Le, Majid Abdolshah, Santu Rana +3
2021-11-05
Machine Learning · Statistics
Better Exploration with Optimistic Actor-Critic
Kamil Ciosek, Quan Vuong, Robert Loftin, Katja Hofmann
2019-10-29
Optimization and Control · Mathematics
Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms
Zhenjie Ren, Xiaoli Wei, Xiang Yu, Xun Yu Zhou
2026-05-01
Machine Learning · Computer Science
Distributional Soft Actor-Critic: Off-Policy Reinforcement Learning for Addressing Value Estimation Errors
Jingliang Duan, Yang Guan, Shengbo Eben Li, Yangang Ren +1
2021-06-14
Machine Learning · Computer Science
Mitigating Off-Policy Bias in Actor-Critic Methods with One-Step Q-learning: A Novel Correction Approach
Baturay Saglam, Dogan C. Cicek, Furkan B. Mutlu, Suleyman S. Kozat
2023-09-27
Machine Learning · Computer Science
Average-Reward Soft Actor-Critic
Jacob Adamczyk, Volodymyr Makarenko, Stas Tiomkin, Rahul V. Kulkarni
2025-08-06
Machine Learning · Computer Science
Computationally Efficient Reinforcement Learning: Targeted Exploration leveraging Simple Rules
Loris Di Natale, Bratislav Svetozarevic, Philipp Heer, Colin N. Jones
2023-09-13
Machine Learning · Computer Science
Actor-Critic Policy Optimization in Partially Observable Multiagent Environments
Sriram Srinivasan, Marc Lanctot, Vinicius Zambaldi, Julien Perolat +3
2020-06-15