中文

从医学出版物中自动提取疾病风险因子

计算与语言 2024-07-11 v1 机器学习

摘要

我们提出了一种自动识别医学文献中疾病风险因子的新方法,利用生物医学领域的预训练模型,同时针对特定任务进行微调。面对医学文章的多样性和非结构化特性的挑战,我们的研究引入了一个多步骤系统,用于首先识别相关文章,然后根据是否存在风险因素讨论对其进行分类,最后通过问答模型从特定疾病中提取具体的风险因素信息。我们的贡献包括开发用于自动提取风险因素的综合管道,以及编译了几个数据集,这些数据集可作为该领域进一步研究的宝贵资源。这些数据集涵盖广泛的疾病范围以及其相关风险因素,这些风险因素经过通过细粒度评估方案仔细识别和验证。我们进行了自动和详尽的手动评估,显示出令人鼓舞的成果。我们还强调了改进模型和扩大数据集 comprehensiveness 的重要性,以跟上医学研究领域的快速发展。

关键词

引用

@article{arxiv.2407.07373,
  title  = {Automatic Extraction of Disease Risk Factors from Medical Publications},
  author = {Maxim Rubchinsky and Ella Rabinovich and Adi Shraibman and Netanel Golan and Tali Sahar and Dorit Shweiki},
  journal= {arXiv preprint arXiv:2407.07373},
  year   = {2024}
}

备注

BioNLP@ACL2024, 12 pages