函数依赖不一致度量方法的 Shapley 值
数据库
2023-06-22 v4
摘要
量化数据库的不一致性出于多种目的,包括新数据集的可靠性估计和数据清洗中的进展指示。另一目的是将整体不一致性中个体元组的责任程度归因,从而在脏数据的解释或检查中优先处理元组。因此,不一致性量化与归因在知识表示领域以及近来在数据库领域已成为大量研究的主题。与许多其他领域一样,一种常规的责任分担机制来自合作博弈论的 Shapley 值。本文对函数依赖(FD)违反的常见不一致度量中 Shapley 值的复杂性进行了系统研究。对于若干度量,我们建立了关于 Shapley 值计算的 FD 集合在可处理与难处理类之间的完整分类。我们还研究了难处理情形下的近似复杂性。
引用
@article{arxiv.2009.13819,
title = {The Shapley Value of Inconsistency Measures for Functional Dependencies},
author = {Ester Livshits and Benny Kimelfeld},
journal= {arXiv preprint arXiv:2009.13819},
year = {2023}
}