自动化识别开放政府数据门户中的高价值数据集
计算机与社会
2024-06-18 v1 数字图书馆
摘要
高价值数据集在促进创新和透明度、推动经济增长、改善公共服务、支持研究、赋权公民以及促进环境可持续性方面得到广泛认可,在更广泛的开放政府数据运动中扮演着关键角色。然而,由于数据价值的细微差别,识别高价值数据集是一项资源密集且复杂的挑战。我们的提议旨在利用一种基于数据使用统计的用户兴趣详细分析的定量方法,自动化识别开放政府数据门户上的高价值数据集,从而最大限度地减少人工干预。所提出的方法包括提取下载数据、分析指标以识别高价值类别,以及比较不同门户间的高价值数据集。这一自动化过程提供了对数据集使用趋势的宝贵见解,反映了公民的需求和偏好。我们通过将其应用于美国开放政府数据城市门户的样本,展示了该方法的有效性。本研究的实际意义包括有助于在地方和国家层面理解高价值数据集。通过提供一种系统且高效的识别高价值数据集的方法,我们的方法旨在为开放治理倡议和实践提供信息,帮助开放政府数据门户管理者和公共当局优化数据传播和利用。
引用
@article{arxiv.2406.10541,
title = {Automating the Identification of High-Value Datasets in Open Government Data Portals},
author = {Alfonso Quarati and Anastasija Nikiforova},
journal= {arXiv preprint arXiv:2406.10541},
year = {2024}
}