中文

基于熵度量的蛋白质数据库中蛋白质家族分类

生物大分子 2018-06-15 v1

摘要

在本工作中,我们综述了近年来为将蛋白质数据库中氨基酸分布分类为家族和 clan 而发展的基本方法。这是通过随机变量函数、氨基酸出现概率的熵度量来实现的。我们给出了对 Pfam 数据库的深入研究,限制为可由 m 行(蛋白质结构域)与 n 列(氨基酸)的矩形数组表示的家族。本工作也邀请全球科学研究团体采用不同行数与列数进行统计分析,因为我们相信氨基酸分布的数学刻画是对蛋白质结构与演化判定的根本洞见。

关键词

引用

@article{arxiv.1806.05172,
  title  = {The Protein Family Classification in Protein Databases via Entropy Measures},
  author = {R. P. Mondaini and S. C. de Albuquerque Neto},
  journal= {arXiv preprint arXiv:1806.05172},
  year   = {2018}
}