OBDA 基准测试中的数据缩放:VIG 方法
数据库
2016-08-01 v2
摘要
本文描述了 VIG,一种用于基于本体的数据访问(OBDA)背景下基准测试的数据缩放器。数据缩放是数据库社区提出的一种相对较新的方法,它允许将输入数据实例快速放大至其原大小的 s 倍,同时保留某些特定于应用的特征。该方法的优点在于用户无需手动输入要生成数据的特征,这使其特别适用于 OBDA 基准测试,因为数据库模式的复杂性可能对手动输入构成挑战(例如,NPD 基准测试包含 70 个表,部分表包含超过 60 列)。与传统的数据缩放器不同,VIG 包含由 OBDA 映射和本体提供的领域信息以生成数据。VIG 目前用于 NPD 基准测试,但它并非特定于 NPD,可以使用任何数据实例作为种子。VIG 的显著特点是:(1) 简单清晰的生成策略;(2) 高效性,每个值在常数时间内生成,无需访问磁盘或 RAM 来检索先前生成的值;(3) 通用性,数据以 CSV 文件导出,可由任何 RDBMS 系统轻松导入。VIG 是采用 Apache 2.0 许可的 Java 实现,其源代码以 Maven 项目形式在 GitHub (https://github.com/ontop/vig) 上提供。该代码两年来一直由博尔扎诺自由大学的 -ontop- 团队维护。
引用
@article{arxiv.1607.06343,
title = {Data Scaling in OBDA Benchmarks: The VIG Approach},
author = {Davide Lanti and Guohui Xiao and Diego Calvanese},
journal= {arXiv preprint arXiv:1607.06343},
year = {2016}
}
备注
Typo 1: ShallowWellbore -> DevelopmentWellbore Typo 2: f(fname) [page 4] -> f(fid)