Partout:一种用于高效 RDF 处理的分布式引擎
数据库
2012-12-27 v1
摘要
人们对语义网技术日益增长的兴趣不仅导致了 Web 上语义数据的快速增长,还导致了后端应用数量的增加,在某些情况下三元组数量已超过万亿。面对如此海量的数据及未来的增长,现有的用于存储 RDF 和处理 SPARQL 查询的最先进系统已不再足够。在本文中,我们介绍了 Partout,这是一种用于在机器集群中高效处理 RDF 的分布式引擎。我们提出了一种基于查询日志对 RDF 数据集进行分片、将分片分配给集群中的节点并寻找最优配置的有效方法。Partout 能够高效处理更新,其查询优化器可为即席 SPARQL 查询生成高效的查询执行计划。我们的实验表明,我们的方法在分片和分布式 SPARQL 查询处理方面优于现有最先进的方法。
引用
@article{arxiv.1212.5636,
title = {Partout: A Distributed Engine for Efficient RDF Processing},
author = {Luis Galárraga and Katja Hose and Ralf Schenkel},
journal= {arXiv preprint arXiv:1212.5636},
year = {2012}
}