将分布词汇对比集成到词嵌入中用于反义-同义区分
计算与语言
2016-05-26 v1
摘要
我们提出了一种新颖的向量表示,它将词汇对比集成到分布向量中,并强化了用于确定词语相似程度的最显著特征。改进后的向量显著优于标准模型,并在跨词类(形容词、名词、动词)的反义词与同义词区分中达到了 0.66-0.76 的平均精度。此外,我们将词汇对比向量集成到跳字模型的目标函数中。这种新颖的嵌入在预测 SimLex-999 中的词语相似度以及区分反义词与同义词方面,均优于最先进的模型。
引用
@article{arxiv.1605.07766,
title = {Integrating Distributional Lexical Contrast into Word Embeddings for Antonym-Synonym Distinction},
author = {Kim Anh Nguyen and Sabine Schulte im Walde and Ngoc Thang Vu},
journal= {arXiv preprint arXiv:1605.07766},
year = {2016}
}
备注
6 pages, 4 figures, InProc ACL 2016