一种基于双语与多语料训练的医学同义词识别增强计算特征选择方法
计算与语言
2018-12-06 v1 信息检索
摘要
医学同义词识别一直是医学自然语言处理(NLP)的重要组成部分。然而,在中文医学同义词识别领域,存在精确率低、召回率低等问题。为解决该问题,本文提出一种中文医学同义词识别方法。我们首先选取了包含中英文特征在内的 13 个特征,然后研究了每个特征单独及不同特征组合下的同义词识别结果。通过对识别结果的比较,给出了一种用于中文医学同义词识别的最优特征组合。实验表明,我们选取的特征取得了 97.37% 的精确率、96.00% 的召回率和 97.33% 的 F1 值。
引用
@article{arxiv.1812.01879,
title = {An enhanced computational feature selection method for medical synonym identification via bilingualism and multi-corpus training},
author = {K. Lei and S. Si and D. Wen and Y. Shen},
journal= {arXiv preprint arXiv:1812.01879},
year = {2018}
}