数据库的无歧义优先修复
数据库
2016-03-08 v1
摘要
在其传统定义中,不一致数据库的修复是一个一致数据库,它以“最小方式”不同于不一致数据库。通常,修复并非同等合理,因为希望偏好某一个而非另一个;例如,一个事实被认为比另一个更可靠,或较新事实应优先于较早事实。受这些考虑驱动,研究人员在拒绝约束和子集修复背景下引入并研究了优先修复框架。其中,事实间的优先关系被提升为一致数据库间的优先关系,且修复被限制为在提升意义下最优的那些。已提出三种提升(及最优修复)概念:帕累托、全局和补全。本文研究了判定优先关系是否足以无歧义地清理数据库,换言之,是否存在恰好一个最优修复的复杂性。我们展示了不同的提升语义导致高度不同的复杂性。在帕累托最优下,对于每套函数依赖(FDs),该问题在数据复杂性下是coNP完全的,除非是可处理情况(等价于)每个关系一个FD。在全局最优下,每个关系一个FD仍是可处理的,但我们确立了具有两个FD的关系的 完全性。相反,在补全最优下,该问题对每套FD都可在多项式时间内求解。事实上,我们给出了针对任意冲突超图的多项式时间算法。我们进一步表明,在传递性的一般假设下,该算法甚至对全局最优也解决问题。该算法极其简单,但其正确性证明相当复杂。
引用
@article{arxiv.1603.01820,
title = {Unambiguous Prioritized Repairing of Databases},
author = {Benny Kimelfeld and Ester Livshits and Liat Peterfreund},
journal= {arXiv preprint arXiv:1603.01820},
year = {2016}
}