中文

基于图结构反馈的多公平性正则化在线学习

机器学习 2026-05-25 v2 人工智能

摘要

在自动决策系统中,需要强制执行多个常常相互竞争的公平性措施。这些公平性目标的合适权重通常事先未知,可能随时间变化,并且在本研究中必须通过顺序交互来学习适应。在本工作中,我们在 bandit 环境中解决了这一挑战,其中决策以图结构反馈形式进行。

关键词

引用

@article{arxiv.2508.14311,
  title  = {Online Learning with Multiple Fairness Regularizers via Graph-Structured Feedback},
  author = {Quan Zhou and Jakub Marecek and Robert Shorten},
  journal= {arXiv preprint arXiv:2508.14311},
  year   = {2026}
}

备注

Published in Transactions on Machine Learning Research (TMLR), 2026. OpenReview: https://openreview.net/forum?id=y8iWuDZtEw