基于准 SLCA 的概率 XML 数据关键词查询处理
数据库
2013-01-14 v1
摘要
概率阈值查询是不确定数据库中最常见的查询之一,其中满足查询的结果也必须满足概率阈值要求。本文研究了此前未被探讨过的 XML 数据上的概率阈值关键词查询 (PrTKQ)。我们首先引入了准 SLCA 的概念,并在考虑可能世界语义的情况下用它来表示 PrTKQ 的结果。接着,我们设计了一种概率倒排 (PI) 索引,该索引可根据我们提出的下界/上界快速返回合格答案并过滤掉不合格答案。随后,我们提出了两种高效且可比的算法:基线算法和基于 PI 索引的算法。为了加速算法性能,我们还利用了概率密度函数。使用真实和合成数据集的实证研究验证了我们方法的有效性和效率。
引用
@article{arxiv.1301.2362,
title = {Quasi-SLCA based Keyword Query Processing over Probabilistic XML Data},
author = {Jianxin Li and Chengfei Liu and Rui Zhou and Jeffrey Xu Yu},
journal= {arXiv preprint arXiv:1301.2362},
year = {2013}
}