中文

将分布词汇对比集成到词嵌入中用于反义-同义区分

计算与语言 2016-05-26 v1

摘要

我们提出了一种新颖的向量表示,它将词汇对比集成到分布向量中,并强化了用于确定词语相似程度的最显著特征。改进后的向量显著优于标准模型,并在跨词类(形容词、名词、动词)的反义词与同义词区分中达到了 0.66-0.76 的平均精度。此外,我们将词汇对比向量集成到跳字模型的目标函数中。这种新颖的嵌入在预测 SimLex-999 中的词语相似度以及区分反义词与同义词方面,均优于最先进的模型。

关键词

引用

@article{arxiv.1605.07766,
  title  = {Integrating Distributional Lexical Contrast into Word Embeddings for Antonym-Synonym Distinction},
  author = {Kim Anh Nguyen and Sabine Schulte im Walde and Ngoc Thang Vu},
  journal= {arXiv preprint arXiv:1605.07766},
  year   = {2016}
}

备注

6 pages, 4 figures, InProc ACL 2016