中文

波兰语词义消歧中的语言模型

计算与语言 2021-11-30 v1 人工智能

摘要

本文中,我们测试了两种针对波兰语的无监督词义消歧方法。两种方法均使用神经语言模型预测与待消歧词相似的词,并基于这些词以不同方式预测词义划分。第一种方法对所选相似词聚类,第二种对表示其子集的向量聚类。评估在标注了plWordNet义项的文本上进行,取得了相对良好的结果(所有歧义词的F1=0.68)。结果显著优于\cite{waw:myk:17:Sense}中提出的基于神经模型的无监督方法,并达到其中有监督方法的水平。所提方法可成为解决缺乏义项标注数据的语言的词义消歧问题的途径。

关键词

引用

@article{arxiv.2111.13982,
  title  = {Language models in word sense disambiguation for Polish},
  author = {Agnieszka Mykowiecka and Agnieszka A. Mykowiecka and Piotr Rychlik},
  journal= {arXiv preprint arXiv:2111.13982},
  year   = {2021}
}