k-mer频率的概率模型(扩展摘要)
定量方法
2022-01-03 v1
摘要
本文中,我们综述了用于建模DNA测序数据中定长字符串(k-mer)丰度的现有概率模型。这些模型捕捉了丰度对多种现象的依赖关系,例如基因组大小与重复序列含量、杂合度水平以及测序错误率。这进而允许从真实数据中观测到的k-mer丰度直方图估计这些属性。我们也简要讨论了在相关测序样本间比较k-mer丰度以及有意义地汇总结果的问题。
引用
@article{arxiv.2112.15107,
title = {Probabilistic Models of k-mer Frequencies (Extended Abstract)},
author = {Askar Gafurov and Tomáš Vinař and Broňa Brejová},
journal= {arXiv preprint arXiv:2112.15107},
year = {2022}
}