中文

大数据与业务分析中两种不同流失预测方法的比较——聚焦于 Apache Spark 的应用

分布式、并行与集群计算 2021-06-01 v1 人工智能

摘要

由于大数据分析的重要意义,尤其在改进服务、寻找潜在客户以及选择管理收支的实用方法等业务相关主题中,许多公司试图与科学家合作,以弄清他们应当分析什么、为何分析以及如何分析。本工作中,我们比较并讨论大数据业务分析课题中采用的两种不同方法,更侧重于它们如何利用 Spark。两项研究均以流失预测作为其所提方法的案例研究,因为对公司而言,识别客户打算离开或停止使用其服务是业务分析中的重要课题。在此我们聚焦于 Apache Spark,因为近年来它提供了若干高效处理海量数据的方案。Spark 的这一特性使其成为应对大数据问题的最强候选工具之一,尤其在时间和资源受限时。

关键词

引用

@article{arxiv.2105.15147,
  title  = {Comparing Two Different Approaches in Big Data and Business Analysis for Churn Prediction with the Focus on How Apache Spark Employed},
  author = {Mohammad Sina Kiarostami},
  journal= {arXiv preprint arXiv:2105.15147},
  year   = {2021}
}