中文

面向孟加拉手写数字识别的 NumtaDB 图像预处理

计算机视觉与模式识别 2020-08-19 v1 机器学习

摘要

NumtaDB 是迄今为止最大的孟加拉语手写数字数据集集合。这是一个包含超过 85000 张图像的多样化数据集。但这种多样性也使得该数据集非常难以处理。本文的目标是寻找预处理图像的基准,使其在任何机器学习模型上都能获得良好的准确率。原因在于,目前还没有像英文数字对应 MNIST 那样可供使用的孟加拉数字识别预处理数据。

关键词

引用

@article{arxiv.2008.07853,
  title  = {Image Pre-processing on NumtaDB for Bengali Handwritten Digit Recognition},
  author = {Ovi Paul},
  journal= {arXiv preprint arXiv:2008.07853},
  year   = {2020}
}

备注

5 pages, 8 figures and 4 tables