使用随机访问与随机序枚举回答(并查的)合取查询
数据库
2019-12-24 v1
摘要
随着数据分析对数字系统愈发关键,刻画可被更高效求值的数据库查询也愈发重要。我们考虑在线性时间预处理阶段后以多对数延迟进行答案枚举这一易处理性标尺。此类求值通过在预处理阶段构造支持多对数延迟枚举的数据结构获得。本文中,我们寻求一种支持更严苛任务“随机排列”的结构:以真正随机序进行多对数延迟枚举。若下游应用假定中间结果在统计上有价值地代表整个结果集,则需要此类枚举。更严苛的任务是“随机访问”:在多对数时间内检索给定位置处的答案。我们确立自由连通无环CQ在三种意义上均易处理:枚举、随机序枚举与随机访问;且在无自连接时,由既往结果可知其余每个CQ在三种意义下均难处理(在某些细粒度复杂度假设下)。然而,三种标尺在并查CQ(UCQ)情形下分离:尽管自由连通无环CQ的并查具有易处理枚举,但其可能(可证地)不容许随机访问。对此类UCQ我们设计了期望延迟为对数的随机序枚举。我们还识别出可为其提供多对数访问时间随机访问的UCQ子类。最后,我们给出一种实现与实证研究,显示我们的随机序枚举方法相较最先进替代方案具有显著实际优越性。
引用
@article{arxiv.1912.10704,
title = {Answering (Unions of) Conjunctive Queries using Random Access and Random-Order Enumeration},
author = {Nofar Carmeli and Shai Zeevi and Christoph Berkholz and Benny Kimelfeld and Nicole Schweikardt},
journal= {arXiv preprint arXiv:1912.10704},
year = {2019}
}