基于强化学习的华法林剂量估计
机器学习
2021-09-17 v1 人工智能
摘要
本文尝试使用强化学习对患者华法林(Warfarin)的合适剂量进行建模。论文首先考察了两个基线:一个35 mg/周的固定剂量模型和一个依赖患者数据的线性模型。我们实现了一种LinUCB bandit,在regret和错误百分比度量上提升了性能。在LinUCB bandit基础上,我们尝试了在线监督学习和奖励重塑以进一步提升性能。我们的结果明显优于基线,并展示了使用多臂bandit和人工智能辅助医生决定合适剂量的前景。
引用
@article{arxiv.2109.07564,
title = {Estimation of Warfarin Dosage with Reinforcement Learning},
author = {Arpita Vats},
journal= {arXiv preprint arXiv:2109.07564},
year = {2021}
}