中文

k-mer频率的概率模型(扩展摘要)

定量方法 2022-01-03 v1

摘要

本文中,我们综述了用于建模DNA测序数据中定长字符串(k-mer)丰度的现有概率模型。这些模型捕捉了丰度对多种现象的依赖关系,例如基因组大小与重复序列含量、杂合度水平以及测序错误率。这进而允许从真实数据中观测到的k-mer丰度直方图估计这些属性。我们也简要讨论了在相关测序样本间比较k-mer丰度以及有意义地汇总结果的问题。

关键词

引用

@article{arxiv.2112.15107,
  title  = {Probabilistic Models of k-mer Frequencies (Extended Abstract)},
  author = {Askar Gafurov and Tomáš Vinař and Broňa Brejová},
  journal= {arXiv preprint arXiv:2112.15107},
  year   = {2022}
}