中文

类比、同义词、反义词与关联的统一处理方法

计算与语言 2008-09-02 v1 信息检索 机器学习

摘要

识别类比、同义词、反义词和关联似乎是四个不同的任务,需要不同的自然语言处理算法。过去,这四个任务被独立处理,使用了多种多样的算法。然而,这四种语义类别只是全部语义现象中的一小部分,我们无法为每种语义现象都创建专门的算法;我们需要寻求一种统一的方法。我们提议将广泛的现象归入类比之下。为限制本文范围,我们将注意力限制在同义词、反义词和关联的归并上。我们引入了一种有监督的基于语料库的机器学习算法,用于对类比词对进行分类,并证明它可以解决多项选择的SAT类比问题、托福同义词问题、ESL同义-反义词问题以及认知心理学中的相似-关联-两者问题。

关键词

引用

@article{arxiv.0809.0124,
  title  = {A Uniform Approach to Analogies, Synonyms, Antonyms, and Associations},
  author = {Peter D. Turney},
  journal= {arXiv preprint arXiv:0809.0124},
  year   = {2008}
}

备注

related work available at http://purl.org/peter.turney/