中文

环游世界寻找另一个我——基于 Spark 的大规模语义轨迹分析

分布式、并行与集群计算 2022-04-05 v1

摘要

在当今社会,基于位置的服务被广泛使用,收集了大量人类轨迹。分析这些轨迹的语义含义可惠及众多现实应用,如产品广告、好友推荐和社会行为分析。然而,现有关于语义轨迹的研究多为集中式方法,无法跟上快速增长的轨迹数据规模。本文提出一种在 Apache Spark 中的新型大规模语义轨迹分析算法。我们设计了一种新的哈希函数以及高效的分布式算法,能够快速计算语义轨迹相似度并识别全球范围内具有相似行为的人群社区。实验结果表明,我们的方法比集中式方法快 30 倍以上,且不像其他并行方法那样牺牲任何精度。

关键词

引用

@article{arxiv.2204.00878,
  title  = {Find Another Me Across the World -- Large-scale Semantic Trajectory Analysis Using Spark},
  author = {Chaoquan Cai and Dan Lin},
  journal= {arXiv preprint arXiv:2204.00878},
  year   = {2022}
}