通过零知识链接遍历可回答多少以及何种类型的 SPARQL 查询?
数据库
2021-07-30 v1
摘要
当前查询数据万维网(de-facto Web of Data)的事实标准是 SPARQL 协议,即客户端通过 SPARQL 端点向服务器发送查询。与 HTTP 服务器不同,提供并维护一个健壮可靠的端点需要大量工作,并非所有发布者都愿意或能够承担。一种替代的查询评估方法是通过链接遍历,即在运行时解引用在线网络资源(URI)来回答查询。尽管已提出多种此类基于查找的查询评估方法,但尚不存在对可直接在实时万维网上回答、无需访问本地或远程端点且无需先验了解可用数据源的查询类型(模式)的分析。本文中,我们首先提供一种方法,用于检查一个 SPARQL 查询(将在 SPARQL 端点上评估)是否可通过零知识链接遍历(不访问端点)回答,并分析大型真实 SPARQL 查询日志语料库,以发现可回答与不可回答查询模式的频率与分布。随后,我们提供一种将可回答查询转换为绕过端点的 SPARQL-LD 查询的算法。我们报告了关于转换后查询效率的实验结果,并讨论了该查询评估方法的优势与局限。
引用
@article{arxiv.1901.04954,
title = {How Many and What Types of SPARQL Queries can be Answered through Zero-Knowledge Link Traversal?},
author = {Pavlos Fafalios and Yannis Tzitzikas},
journal= {arXiv preprint arXiv:1901.04954},
year = {2021}
}
备注
Preprint of paper accepted for publication in the 34th ACM/SIGAPP Symposium On Applied Computing (SAC 2019)