中文

面向 Twitter 数据流的特定主题流分类预处理算法

计算与语言 2017-05-30 v1

摘要

微博服务 Twitter 是全球情感数据挖掘应用的丰厚数据源。但由于每条数据项中提及的主题多种多样,直接对原始数据运行数据挖掘算法效率低下。本文讨论了一种算法,能将整个数据流精确分类为给定数量的互斥且完全穷尽的子流,从而可以在每个子流上分别运行数据挖掘算法,以高效率获得更具相关性的结果。

关键词

引用

@article{arxiv.1705.09995,
  title  = {Subject Specific Stream Classification Preprocessing Algorithm for Twitter Data Stream},
  author = {Nisansa de Silva and Danaja Maldeniya and Chamilka Wijeratne},
  journal= {arXiv preprint arXiv:1705.09995},
  year   = {2017}
}

备注

6 pages