中文

扩展快速搜索聚类算法:宽泛密度簇,无密度峰

数据结构与算法 2015-05-22 v1

摘要

CFSFDP(通过快速搜索和发现密度峰聚类)是近年来提出的基于密度的聚类算法。与 DBSCAN 相比,它需要更少的参数,且因非迭代而计算代价低。Alex 等人已通过许多应用展示了其功效。然而,当一个簇存在多个密度峰(我们称之为“无密度峰”)时,CFSFDP 表现不佳。本文受层次聚类算法 CHAMELEON 思想的启发,提出 CFSFDP 的扩展 E_CFSFDP,以适应更多应用。具体而言,我们首先利用原始 CFSFDP 生成初始簇,然后在第二阶段合并子簇。我们在多个具有“无密度峰”的数据集上执行了该算法。实验结果表明,由于突破了数据集的严格限制,我们的方法优于原始方法。

关键词

引用

@article{arxiv.1505.05610,
  title  = {Extended fast search clustering algorithm: widely density clusters, no density peaks},
  author = {Wenkai Zhang and Jing Li},
  journal= {arXiv preprint arXiv:1505.05610},
  year   = {2015}
}

备注

18 pages, 10 figures, DBDM 2015