西班牙语临床叙述中的肺癌概念标注
人工智能
2018-09-24 v1 计算与语言
摘要
近期临床数据生成的快速增长与计算科学的迅速发展,使我们能够从医疗行业的海量数据集中提取新的洞见。肿瘤学临床笔记正在创建丰富的数据库以记录患者病史,其中潜在包含许多有助于更好地管理疾病的模式。然而,这些模式被锁定在临床文档的自由文本(非结构化)部分中,导致健康专业人员难以从中提取有用信息,并最终难以准确地执行问答(QA)过程。信息抽取(IE)过程需要自然语言处理(NLP)技术来为这些模式赋予语义。因此,本文中我们分析可集成于 Apache Unstructured Information Management Architecture(UIMA)框架之上的特定肺癌概念标注器的设计。此外,我们解释了标注结果的生成与存储细节。
引用
@article{arxiv.1809.06639,
title = {Lung Cancer Concept Annotation from Spanish Clinical Narratives},
author = {Marjan Najafabadipour and Juan Manuel Tuñas and Alejandro Rodríguez-González and Ernestina Menasalvas},
journal= {arXiv preprint arXiv:1809.06639},
year = {2018}
}
备注
10 pages, 6 figures