大数据:理解大数据
分布式、并行与集群计算
2016-01-19 v1 数据库
摘要
史蒂夫·乔布斯,我们这个时代最伟大的远见者之一,在1996年被引述说“很多时候,人们不知道自己想要什么,直到你展示给他们看”[38],表明他主张基于人类直觉而非研究来开发产品。随着移动设备、社交网络与物联网(Internet of Things)的进步,海量复杂数据(包括结构化和非结构化)正被捕获,希望使组织能够做出更好的业务决策,因为数据如今对组织的成功至关重要。这些海量数据被称为大数据(Big Data),当被适当处理与分析时,其可使组织获得超越竞争对手的竞争优势。然而大数据分析(Big Data Analytics)存在一些关切,包括数据生命周期管理、隐私与安全以及数据表示。本文回顾了大数据的基本概念、数据存储领域、用于处理这些大型数据集的MapReduce编程范式,并聚焦于两个展示大数据分析有效性的案例研究,且提出了若处理得当其在未来如何能带来更大益处。
引用
@article{arxiv.1601.04602,
title = {Big Data: Understanding Big Data},
author = {Kevin Taylor-Sakyi},
journal= {arXiv preprint arXiv:1601.04602},
year = {2016}
}
备注
8 pages, Big Data Analytics, Data Storage, MapReduce, Knowledge-Space, Big Data Inconsistencies