开放数据平台上集成假设的识别与加权
数据库
2012-05-14 v1
摘要
开放数据平台如data.gov或opendata.socrata.com提供了大量有价值的信息。它们的自由开放性质、缺乏发布标准以及平台上代表的多领域和多作者导致了新的集成和标准化问题。同时,基于众包的数据集成技术正在成为处理这些问题的新方法。然而,这些方法仍然需要以特定问题或任务的形式输入,以便传递给众包。本文讨论了开放数据平台上的集成问题,并提出了一种在此背景下识别和排序集成假设的方法。我们将通过在最大的开放数据平台之一上进行全面评估来验证我们的发现。
引用
@article{arxiv.1205.2465,
title = {Identifying And Weighting Integration Hypotheses On Open Data Platforms},
author = {Julian Eberius and Katrin Braunschweig and Maik Thiele and Wolfgang Lehner},
journal= {arXiv preprint arXiv:1205.2465},
year = {2012}
}
备注
Presented at the First International Workshop On Open Data, WOD-2012 (http://arxiv.org/abs/1204.3726)