MNIST-MIX:一种多语言手写数字识别数据集
计算机视觉与模式识别
2021-01-28 v1 机器学习
摘要
在本文中,我们贡献了一个名为 MNIST-MIX 的多语言手写数字识别数据集,就语言种类和数据样本数量而言,它是同类中最大的数据集。MNIST-MIX 采用与 MNIST 相同的数据格式,可无缝应用于现有的手写数字识别研究。通过引入来自 10 种不同语言的 digit,MNIST-MIX 成为一个更具挑战性的数据集,其不平衡分类需要更好的模型设计。我们还给出了将已在 MNIST 上预训练的 LeNet 模型作为基线应用的结果。
引用
@article{arxiv.2004.03848,
title = {MNIST-MIX: A Multi-language Handwritten Digit Recognition Dataset},
author = {Weiwei Jiang},
journal= {arXiv preprint arXiv:2004.03848},
year = {2021}
}
备注
3 pages, 1 figure, 2 tables