中文

布隆过滤器在大数据研究中的作用:综述

数据库 2019-03-18 v1

摘要

大数据是最受欢迎的新兴趋势,已成为人类的福祉,也是日常生活的必需品。例如 Facebook。每个人都直接或间接地参与产生数据。因此,大数据是一种具有高增长率且由多样数据组成的大量数据。大数据触及所有领域,包括政府部门、IT 产业、商业、经济、工程、生物信息学和其他基础科学。因此,大数据形成了数据孤岛。大多数数据是重复且非结构化的。为处理此类数据孤岛,布隆过滤器是过滤重复数据的宝贵资源。此外,布隆过滤器在大数据存储系统中对于优化内存消耗是不可或缺的。毫无疑问,布隆过滤器使用极少量的内存空间来过滤非常大的数据规模,并存储大量数据集的信息。然而,布隆过滤器的功能仅限于成员资格过滤,但它可适用于各种应用。此外,布隆过滤器部署于不同领域,也用于跨学科研究领域,例如生物信息学。在本文中,我们揭示了布隆过滤器在大数据研究中的有用性。

关键词

引用

@article{arxiv.1903.06565,
  title  = {Role of Bloom Filter in Big Data Research: A Survey},
  author = {Ripon Patgiri and Sabuzima Nayak and Samir Kumar Borgohain},
  journal= {arXiv preprint arXiv:1903.06565},
  year   = {2019}
}

备注

7 Pages, 3 Figures, 1 Table