中文

基于协调标注的多语言共指消解

计算与语言 2021-09-06 v2

摘要

本文使用新创建的多语言语料库CorefUD进行共指消解实验。我们关注以下语言:捷克语、俄语、波兰语、德语、西班牙语和加泰罗尼亚语。除单语实验外,我们在多语言实验中合并训练数据并训练两个联合模型——一个针对斯拉夫语,一个针对所有语言。我们基于端到端深度学习模型,并针对CorefUD语料库稍作调整。结果表明,利用协调标注可获益,且使用联合模型对训练数据较少的语言帮助显著。

关键词

引用

@article{arxiv.2107.12088,
  title  = {Multilingual Coreference Resolution with Harmonized Annotations},
  author = {Ondřej Pražák and Miloslav Konopík and Jakub Sido},
  journal= {arXiv preprint arXiv:2107.12088},
  year   = {2021}
}