中文

用于自动同源词识别与系统发育推断的间隙加权子序列

计算与语言 2014-08-25 v2

摘要

本文描述了同源词识别问题及其与系统发育推断的关系。我们引入了基于子序列的特征,用于区分同源词与非同源词。研究表明,就同源词识别而言,基于子序列的特征表现优于最先进的字符串相似度度量。我们将同源词判定结果用于系统发育推断,观察到这些分类器推断出的树与金标准树非常接近。本文的贡献在于将子序列特征用于同源词识别,并利用同源词判定进行系统发育推断。

关键词

引用

@article{arxiv.1408.2359,
  title  = {Gap-weighted subsequences for automatic cognate identification and phylogenetic inference},
  author = {Taraka Rama},
  journal= {arXiv preprint arXiv:1408.2359},
  year   = {2014}
}