用于 uplift 建模的强化学习
机器学习
2019-02-06 v2 机器学习
摘要
Uplift 建模旨在直接建模处理对个体响应的增量影响。在这项工作中,我们从一个新角度解决该问题,并将其重新表述为一个马尔可夫决策过程(MDP)。我们在合成数据集和真实场景上进行了大量实验,表明我们的方法相比先前方法能取得显著改进。
引用
@article{arxiv.1811.10158,
title = {Reinforcement Learning for Uplift Modeling},
author = {Chenchen Li and Xiang Yan and Xiaotie Deng and Yuan Qi and Wei Chu and Le Song and Junlong Qiao and Jianshan He and Junwu Xiong},
journal= {arXiv preprint arXiv:1811.10158},
year = {2019}
}