Machine Learning · Computer Science
Towards Principled, Practical Policy Gradient for Bandits and Tabular MDPs
Michael Lu, Matin Aghaei, Anant Raj, Sharan Vaswani
2024-10-01
Machine Learning · Computer Science
Small steps no more: Global convergence of stochastic gradient bandits for arbitrary learning rates
Jincheng Mei, Bo Dai, Alekh Agarwal, Sharan Vaswani +3
2025-02-12
Machine Learning · Statistics
Fast Best-in-Class Regret for Contextual Bandits
Samuel Girard, Aurelien Bibaut, Arthur Gretton, Nathan Kallus +1
2026-04-06
Machine Learning · Computer Science
Stochastic Gradient Succeeds for Bandits
Jincheng Mei, Zixin Zhong, Bo Dai, Alekh Agarwal +2
2024-02-28
Machine Learning · Computer Science
Better Best of Both Worlds Bounds for Bandits with Switching Costs
Idan Amir, Guy Azov, Tomer Koren, Roi Livni
2022-11-03
Machine Learning · Computer Science
Tight Regret Bounds for Stochastic Combinatorial Semi-Bandits
Branislav Kveton, Zheng Wen, Azin Ashkan, Csaba Szepesvari
2017-06-08
Machine Learning · Computer Science
Stochastic Bandits Robust to Adversarial Attacks
Xuchuang Wang, Jinhang Zuo, Xutong Liu, John C. S. Lui +1
2024-08-19
Machine Learning · Computer Science
Best-of-Both-Worlds Algorithms for Linear Contextual Bandits
Yuko Kuroki, Alberto Rumi, Taira Tsuchiya, Fabio Vitale +1
2024-02-20
Machine Learning · Computer Science
Near-Optimal Algorithms for Differentially Private Online Learning in a Stochastic Environment
Bingshan Hu, Zhiming Huang, Nishant A. Mehta, Nidhi Hegde
2024-05-31