中文

POND:悲观-乐观在线调度算法

机器学习 2021-05-12 v2 最优化与控制

摘要

本文研究具有未知到达、奖励与约束分布的约束在线调度问题。我们提出一种新颖的在线调度算法,命名为 POND,即 Pessimistic-Optimistic oNline Dispatching(悲观-乐观在线调度),其实现了 O(T)O(\sqrt{T}) 后悔值与 O(1)O(1) 约束违反。两个界均为紧界。我们在合成与真实数据集上的实验表明,POND 以最小的约束违反实现了低后悔值。

关键词

引用

@article{arxiv.2010.09995,
  title  = {POND: Pessimistic-Optimistic oNline Dispatching},
  author = {Xin Liu and Bin Li and Pengyi Shi and Lei Ying},
  journal= {arXiv preprint arXiv:2010.09995},
  year   = {2021}
}