NLNDE:非语言非领域专家式的西班牙语医疗文档去标识化方法
计算与语言
2020-07-03 v1 机器学习
摘要
自然语言处理在医疗领域具有巨大潜力,近来引发了该领域的诸多研究。然而,安全处理医疗文档(例如患者笔记和临床试验)的一个先决条件是对隐私敏感信息进行适当的去标识化。在本文中,我们描述了我们的 NLNDE 系统,我们凭借该系统参与了 MEDDOCAN 竞赛,即 IberLEF 2019 的医疗文档匿名化任务。我们将从西班牙语数据中检测和分类受保护健康信息的任务视为序列标注问题,并研究了神经网络的不同嵌入方法。尽管处于非标准语言和领域的设定下,NLNDE 系统在竞赛中取得了有前景的结果。
引用
@article{arxiv.2007.01030,
title = {NLNDE: The Neither-Language-Nor-Domain-Experts' Way of Spanish Medical Document De-Identification},
author = {Lukas Lange and Heike Adel and Jannik Strötgen},
journal= {arXiv preprint arXiv:2007.01030},
year = {2020}
}
备注
Published at IberLEF 2019. Winning System of the MEDDOCAN shared task