中文

用于评估分布式表示的自动多语言聚类生成

计算与语言 2017-04-06 v5 机器学习

摘要

我们提出了一种与语言无关的方法,自动生成语义相似实体簇的集合以及“离群”元素的集合,然后可将它们用于离群点检测任务中对词嵌入进行内在评估。我们使用我们的方法创建了一个金标准数据集,称之为 WikiSem500,并评估了多个最先进的嵌入。结果显示在该数据集上的性能与在情感分析上的性能之间存在相关性。

关键词

引用

@article{arxiv.1611.01547,
  title  = {Automated Generation of Multilingual Clusters for the Evaluation of Distributed Representations},
  author = {Philip Blair and Yuval Merhav and Joel Barry},
  journal= {arXiv preprint arXiv:1611.01547},
  year   = {2017}
}

备注

Published as a workshop paper at ICLR 2017