基于图结构反馈的多公平性正则化在线学习
机器学习
2026-05-25 v2 人工智能
摘要
在自动决策系统中,需要强制执行多个常常相互竞争的公平性措施。这些公平性目标的合适权重通常事先未知,可能随时间变化,并且在本研究中必须通过顺序交互来学习适应。在本工作中,我们在 bandit 环境中解决了这一挑战,其中决策以图结构反馈形式进行。
引用
@article{arxiv.2508.14311,
title = {Online Learning with Multiple Fairness Regularizers via Graph-Structured Feedback},
author = {Quan Zhou and Jakub Marecek and Robert Shorten},
journal= {arXiv preprint arXiv:2508.14311},
year = {2026}
}
备注
Published in Transactions on Machine Learning Research (TMLR), 2026. OpenReview: https://openreview.net/forum?id=y8iWuDZtEw