面向发展的手机数据中隐私-效用权衡的映射
计算机与社会
2018-08-02 v1 密码学与安全
综合经济学
经济学
摘要
当今的数据时代具有极大潜力,可增强我们在发展与人道主义行动领域追求和监测进展的方式。我们研究了大规模行为数据中数据效用与隐私风险之间的关系,聚焦于以手机元数据为范式领域。为衡量效用,我们调查了专家关于不同空间和时间粒度级别下手机元数据的价值。为衡量隐私,我们提出一种形式化且直观的重新识别风险度量——信息比——并在每个粒度级别上计算它。我们的结果证实了数据效用与可重新识别性之间存在显著权衡,其中最有价值的数据集也最易于被重新识别。当数据以 ZIP 编码和小时级别指定时,仅知晓个人数据的 7% 外部知识就足以重新识别并检索剩余的 93%。相反,在价值最低的数据集(以市镇和日级别指定)中,重新识别平均需要个人数据的 51%(即 31 个数据点)的外部知识才能检索剩余的 49%。总体而言,我们的发现表明,数据粗化直接侵蚀其价值,并强调需要将数据粗化用作组合式机制,而非独立机制,且需与提供可调问责与安全级别的数据共享模型结合使用。
引用
@article{arxiv.1808.00160,
title = {Mapping the Privacy-Utility Tradeoff in Mobile Phone Data for Development},
author = {Alejandro Noriega-Campero and Alex Rutherford and Oren Lederman and Yves A. de Montjoye and Alex Pentland},
journal= {arXiv preprint arXiv:1808.00160},
year = {2018}
}