中文

Quick, Stat!:对 Quick, Draw! 数据集的统计分析

计算机视觉与模式识别 2019-10-24 v2 数据库 图像与视频处理

摘要

Quick, Draw! 数据集是谷歌的一个数据集,包含来自 Quick, Draw! 游戏用户的 5000 万幅绘画,分为 345 个类别。与大多数现有图像数据集不同,Quick, Draw! 数据集中的绘画以铅笔位置的时间序列而非由像素组成的位图矩阵存储。这一特性使该数据集成为当时最大的涂鸦数据集。Quick, Draw! 数据集被视为研究人员开发和研习机器学习技术的绝佳机会。由于该数据集规模庞大及其来源性质,关于其所含绘画质量的信息十分匮乏。本文对 Quick, Draw! 数据集中三个类别——山、书和鲸鱼——进行了统计分析,旨在让读者对该数据集所收集数据有初步印象。为分析绘画质量,我们训练了一个分类神经网络以获得分类分数。利用该分类分数及数据集提供的参数,给出了关于该数据集中所含绘画质量与性质的统计分析。

关键词

引用

@article{arxiv.1907.06417,
  title  = {Quick, Stat!: A Statistical Analysis of the Quick, Draw! Dataset},
  author = {Raul Fernandez-Fernandez and Juan G. Victores and David Estevez and Carlos Balaguer},
  journal= {arXiv preprint arXiv:1907.06417},
  year   = {2019}
}

备注

12 pages, Eurosim 2019