中文

greed:一个通过贪心最大化积分分类似然实现基于模型聚类的R语言包

统计方法学 2022-05-02 v1

摘要

greed包在R语言中实现了arXiv:2002.11577中提出的通用且灵活的基于模型聚类框架。该包基于对所划分直接最大化精确积分分类似然(Integrated Classification Likelihood),可联合执行聚类与组数选择。这一组合问题通过高效的混合遗传算法处理,而最终层次化步骤可获取更粗的划分并提取簇的排序。该方法适用于多种潜变量模型,因而可处理各类数据类型及异质数据。已实现针对连续、计数、分类及图数据的经典模型,且借助S4类抽象可纳入新模型。本文介绍该包及其开发设计选择,并通过实际用例展示其用法。

关键词

引用

@article{arxiv.2204.14063,
  title  = {greed: An R Package for Model-Based Clustering by Greedy Maximization of the Integrated Classification Likelihood},
  author = {Etienne Côme and Nicolas Jouvin},
  journal= {arXiv preprint arXiv:2204.14063},
  year   = {2022}
}