基于 HMM 的印度语言命名实体识别系统:JU 系统在 ICON 2013 的表现
计算与语言
2014-05-30 v1
摘要
本文报告了我们在 ICON 2013 NLP TOOLS CONTEST 命名实体识别任务中的工作。我们提交了孟加拉语、英语、印地语、马拉地语、旁遮普语、泰米尔语和泰卢固语的参赛结果。我们的系统采用基于统计的隐马尔可夫模型(Hidden Markov Models, HMM)实现,并在 NLP TOOLS CONTEST: ICON 2013 数据集上进行了训练和测试。我们的系统在孟加拉语、英语、印地语、马拉地语、旁遮普语、泰米尔语和泰卢固语上分别获得了 0.8599、0.7704、0.7520、0.4289、0.5455、0.4466 和 0.4003 的 F 值。
引用
@article{arxiv.1405.7397,
title = {An HMM Based Named Entity Recognition System for Indian Languages: The JU System at ICON 2013},
author = {Vivekananda Gayen and Kamal Sarkar},
journal= {arXiv preprint arXiv:1405.7397},
year = {2014}
}
备注
The ICON 2013 tools contest on Named Entity Recognition in Indian languages (IL) co-located with the 10th International Conference on Natural Language Processing(ICON), CDAC Noida, India,18-20 December, 2013