中文

基于强化学习的华法林剂量估计

机器学习 2021-09-17 v1 人工智能

摘要

本文尝试使用强化学习对患者华法林(Warfarin)的合适剂量进行建模。论文首先考察了两个基线:一个35 mg/周的固定剂量模型和一个依赖患者数据的线性模型。我们实现了一种LinUCB bandit,在regret和错误百分比度量上提升了性能。在LinUCB bandit基础上,我们尝试了在线监督学习和奖励重塑以进一步提升性能。我们的结果明显优于基线,并展示了使用多臂bandit和人工智能辅助医生决定合适剂量的前景。

关键词

引用

@article{arxiv.2109.07564,
  title  = {Estimation of Warfarin Dosage with Reinforcement Learning},
  author = {Arpita Vats},
  journal= {arXiv preprint arXiv:2109.07564},
  year   = {2021}
}