一种用于在辅助存储器中索引大型 RDF 数据集以实现高效 SPARQL 求值的无角色方法
数据库
2008-11-20 v1 数据结构与算法
摘要
海量 RDF 数据集正变得普遍。RDF 数据通常产生于社会语义领域(如个人信息管理),其中通常无法预先获得固定模式。我们提出了一种简单的三向三元树(TripleT)辅助存储器索引技术,以促进对此类数据集的高效 SPARQL 查询求值。TripleT 的新颖之处在于:(1)索引是基于数据集中出现的原子构建的,而不是基于更粗的粒度,例如数据集中出现的整个三元组;(2)对原子进行索引时,不考虑它们在数据集三元组中扮演的角色(即主语、谓语或宾语)。我们通过广泛的实证评估表明,在存储和查询处理成本方面,TripleT 比 RDF 索引领域的现有技术提高了多个数量级。
引用
@article{arxiv.0811.1083,
title = {A role-free approach to indexing large RDF data sets in secondary memory for efficient SPARQL evaluation},
author = {George H. L. Fletcher and Peter W. Beck},
journal= {arXiv preprint arXiv:0811.1083},
year = {2008}
}
备注
12 pages, 5 figures, 2 tables