中文

利用二叉搜索树提高 Apriori 算法效率以发现文本或事务数据库中频繁项的方法

数据库 2013-07-30 v1 数据结构与算法

摘要

数据挖掘技术已广泛应用于各种应用中。基于二叉搜索树(Binary Search Tree)的频繁项是一种自动识别最频繁项、最不频繁项和平均频繁项的有效方法。本文提出了一种寻找频繁项的新方法。术语“频繁项”指的是项目在给定输入中出现的次数。该方法利用熟悉的二叉搜索树方法,以任意顺序查找项集。此处采用的方法是通过比较并递增现有事务数据库或文本数据中的计数器变量来找出频繁项。我们还展示了频繁项集的不同方法,并针对该问题的解决提出了一种算法方法。

关键词

引用

@article{arxiv.1307.7513,
  title  = {An Approach Finding Frequent Items In Text Or Transactional Data Base By Using BST To Improve The Efficiency Of Apriori Algorithm},
  author = {P Vasanth Sena},
  journal= {arXiv preprint arXiv:1307.7513},
  year   = {2013}
}

备注

1 Algorithm. arXiv admin note: text overlap with arXiv:1009.4982 by other authors