面向混淆与同步错误的数据库去匿名化:分布无关性分析
信息论
2024-04-03 v1 math.IT
摘要
数据库去匿名化通常涉及将匿名化数据库与相关的公开数据进行匹配。现有研究要么聚焦于无需数据分布知识的实用方面 yet 提供有限保证,要么关注理论方面假设已知数据分布。本文旨在搭建这两种方法之间的壁垒,在不了解数据分布的情况下为数据库去匿名化提供理论保证,同时考虑同步错误和混淆。我们采用修改后的复制检测算法和新的固定删除检测算法,确立数据库增长率的充分条件,表明相对于行大小的双对数种子大小足以检测数据库中的删除。重要的是,我们的发现表明这些充分的去匿名化条件是紧密的,与分布感知 setting 中的条件相同,避免了因分布未知而导致的渐近性能损失。最后,我们通过仿真评估了所提出算法的性能,确认其在更实际的非渐近情景中的有效性。
引用
@article{arxiv.2404.01366,
title = {Distribution-Agnostic Database De-Anonymization Under Obfuscation And Synchronization Errors},
author = {Serhat Bakirtas and Elza Erkip},
journal= {arXiv preprint arXiv:2404.01366},
year = {2024}
}
备注
arXiv admin note: substantial text overlap with arXiv:2309.14484