面向孟加拉手写数字识别的 NumtaDB 图像预处理
计算机视觉与模式识别
2020-08-19 v1 机器学习
摘要
NumtaDB 是迄今为止最大的孟加拉语手写数字数据集集合。这是一个包含超过 85000 张图像的多样化数据集。但这种多样性也使得该数据集非常难以处理。本文的目标是寻找预处理图像的基准,使其在任何机器学习模型上都能获得良好的准确率。原因在于,目前还没有像英文数字对应 MNIST 那样可供使用的孟加拉数字识别预处理数据。
引用
@article{arxiv.2008.07853,
title = {Image Pre-processing on NumtaDB for Bengali Handwritten Digit Recognition},
author = {Ovi Paul},
journal= {arXiv preprint arXiv:2008.07853},
year = {2020}
}
备注
5 pages, 8 figures and 4 tables