中文

文本分类的新前沿:大数据与分布式计算

分布式、并行与集群计算 2019-08-22 v1

摘要

本文档旨在研究利用 Apache Spark 框架提供的功能进行短语分类和排序的算法。基于 Laura Anderlucci、Lucia Guastadisegni 和 Cinzia Viroli 在《Classifying textual data: shallow, deep and ensemble methods》一文中阐述的研究,我们希望对利用分布式环境实现短语分类的可行方案进行研究。意大利语。本文档旨在研究利用 Apache Spark 框架提供的结构进行短语分类和排序的算法。基于 Laura Anderlucci、Lucia Guastadisegni 和 Cinzia Viroli 在《Classifying textual data: shallow, deep and ensemble methods》一文中阐述的研究,我们希望对利用分布式环境实现一种能够对短语进行分类的解决方案的可行实现进行研究。

关键词

引用

@article{arxiv.1908.07917,
  title  = {Nuova frontiera della classificazione testuale: Big data e calcolo distribuito},
  author = {Marco Covelli and Massimiliano Morrelli},
  journal= {arXiv preprint arXiv:1908.07917},
  year   = {2019}
}

备注

in Italian