欧洲人权法院开放数据项目
机器学习
2019-02-05 v2 机器学习
摘要
本文提出了基于欧洲人权法院自成立以来的判决的十三个用于二分类、多分类和多标签分类的数据集。通过研究者、数据科学家、公民和法律从业者的视角解释了此类数据集的意义。与许多数据集相反,从原始数据收集到特征转换的创建过程以一组完全自动化且开源的脚本形式提供。这确保了可重复性以及对处理数据的高置信度,而这是当今数据治理中一些最重要的问题。我们进行了首次实验活动,以研究一些可预测性属性,并在流行的机器学习算法上建立基线结果。在二分类数据集上的结果一致良好,准确率介于 75.86% 和 98.32% 之间,平均准确率为 96.45%。
引用
@article{arxiv.1810.03115,
title = {European Court of Human Right Open Data project},
author = {Alexandre Quemy},
journal= {arXiv preprint arXiv:1810.03115},
year = {2019}
}
备注
Preprint submitted to Data Mining and Knowledge Discovery