真实数据无可替代:不应将出生 - 死亡多分枝解析器构建的系统发育树用于许多下游比较分析
定量方法
2015-03-18 v1 种群与进化
摘要
系统发育树的统计估计总是伴随着不确定性,而容纳这种不确定性是现代系统发育比较分析的重要组成部分。出生 - 死亡多分枝解析器(birth-death polytomy resolver)是一种考虑系统发育不确定性的方法,它仅利用分类学信息将缺失(未采样)的类群放置到系统发育树上。近期关于鸟类和哺乳动物的研究使用了这种方法来生成物种水平完整的系统发育树伪后验分布,即使许多物种缺乏遗传数据。许多研究人员利用这些系统发育树分布进行下游进化分析,涉及表型进化、地理分布和群落组装的推断。我证明,对于许多涉及性状的问题,使用以这种方式构建的系统发育树是不合适的。由于物种是相对于性状值随机放置在树上的,出生 - 死亡多分枝解析器破坏了性状系统发育结构的自然模式。基于这些树的推断可预测地且经常严重地产生偏差,偏差方向取决于性状中潜在(真实)的系统发育结构模式。我利用全球鸟类系统发育树的例子,说明了这种现象对连续性状和离散性状的严重程度。
引用
@article{arxiv.1503.04978,
title = {No substitute for real data: phylogenies from birth-death polytomy resolvers should not be used for many downstream comparative analyses},
author = {Daniel L. Rabosky},
journal= {arXiv preprint arXiv:1503.04978},
year = {2015}
}