医疗保健领域合成数据的共享悖论
数据库
2025-03-28 v1 密码学与安全
计算机与社会
摘要
合成数据通过以隐私友好的方式生成有用的数据集来解决医疗保健领域的隐私问题。然而,尽管合成数据通常是为了共享而开发的,但模糊的重新识别风险评估往往会阻止合成数据实际应用。一个主要原因是,针对合成数据的隐私指标(用于揭示重新识别风险)不符合医疗保健领域关于数据共享的实际要求和法规。本文讨论了合成数据旨在数据共享却常被限制的悖论情况。我们也讨论了该领域应如何前进以缓解此问题。
引用
@article{arxiv.2503.20847,
title = {The Data Sharing Paradox of Synthetic Data in Healthcare},
author = {Jim Achterberg and Bram van Dijk and Saif ul Islam and Hafiz Muhammad Waseem and Parisis Gallos and Gregory Epiphaniou and Carsten Maple and Marcel Haas and Marco Spruit},
journal= {arXiv preprint arXiv:2503.20847},
year = {2025}
}
备注
Accepted for publication at Medical Informatics Europe 2025 conference, Glasgow