中文

系统发育数据开放获取的黎明

种群与进化 2017-02-08 v1 数字图书馆

摘要

科学事业 critically 依赖于已发表数据的保存与开放获取。这一基本原则对于系统发育树(物种间进化关系的估计)尤为迫切。如今,系统发育树正越来越多地基于日益庞大的基因组规模数据集,并使用日益复杂的统计方法进行估计,这需要更高水平的专业知识和计算投入。此外,由此产生的系统发育数据提供了明确的历史视角,为众多科学学科的研究提供了关键信息。其中一种应用是研究谱系多样化速率(物种形成 - 灭绝)随时间的变化。作为该领域元分析的一部分,我们试图收集 13 年间发表在 46 种期刊上的 217 项研究的系统发育数据(包括核苷酸序列比对和树文件)。我们记录了获取这些数据的尝试(通过在线档案和直接向通讯作者请求),并报告了分析结果(使用贝叶斯逻辑回归),以评估各种因素对我们努力成功与否的影响。总体而言,约 60% 研究的完整系统发育数据实际上已对科学界丢失。我们的研究表明,在以下情况下,系统发育数据更有可能被存入在线档案和/或应请求共享:(1) 出版期刊拥有强有力的数据共享政策;(2) 出版期刊具有更高的影响因子;以及 (3) 数据是向教职员工而非学生请求的。尽管形势看似严峻,但我们的分析表明情况远非无望:科学界最近的举措——包括期刊和资助机构的政策变化——正在改善现状。

关键词

引用

@article{arxiv.1405.6623,
  title  = {The Dawn of Open Access to Phylogenetic Data},
  author = {Andrew F. Magee and Michael R. May and Brian R. Moore},
  journal= {arXiv preprint arXiv:1405.6623},
  year   = {2017}
}