随机索引K树
信息检索
2010-02-02 v2 人工智能
数据结构与算法
摘要
随机索引K树是两种聚类算法的结合。文档聚类中存在许多大规模问题。由于复杂度低,RI K树能很好地扩展到大输入规模。它还展现出对管理动态集合有用的特性。此外,它解决了使用K树时稀疏文档向量先前存在的问题。定义、解释并论证了算法和数据结构。针对与RI的结合,对K树进行了特定修改。进行了实验以衡量质量。结果表明,RI K树相比原始K树算法提高了文档聚类质量。
引用
@article{arxiv.1001.0833,
title = {Random Indexing K-tree},
author = {Christopher M. De Vries and Lance De Vine and Shlomo Geva},
journal= {arXiv preprint arXiv:1001.0833},
year = {2010}
}
备注
8 pages, ADCS 2009; Hyperref and cleveref LaTeX packages conflicted. Removed cleveref