中文

随机索引K树

信息检索 2010-02-02 v2 人工智能 数据结构与算法

摘要

随机索引K树是两种聚类算法的结合。文档聚类中存在许多大规模问题。由于复杂度低,RI K树能很好地扩展到大输入规模。它还展现出对管理动态集合有用的特性。此外,它解决了使用K树时稀疏文档向量先前存在的问题。定义、解释并论证了算法和数据结构。针对与RI的结合,对K树进行了特定修改。进行了实验以衡量质量。结果表明,RI K树相比原始K树算法提高了文档聚类质量。

关键词

引用

@article{arxiv.1001.0833,
  title  = {Random Indexing K-tree},
  author = {Christopher M. De Vries and Lance De Vine and Shlomo Geva},
  journal= {arXiv preprint arXiv:1001.0833},
  year   = {2010}
}

备注

8 pages, ADCS 2009; Hyperref and cleveref LaTeX packages conflicted. Removed cleveref