中文

利用类 MNIST 增强数据集的泰米尔语元音识别

计算机视觉与模式识别 2020-06-18 v2 计算与语言

摘要

我们报告生成了一个与 MNIST [4] 兼容的泰米尔语元音数据集 [1],以构建用于泰米尔语 OCR/手写应用的分类 DNN 或其他此类 ML/AI 深度学习 [2] 模型。我们报告了该 60,000 张灰度、28x28 像素数据集在 TensorFlow 中构建具有 100,000+ 参数、4 层 CNN 的能力,其训练准确率为 92%,交叉验证准确率为 82%。我们还报告了同一网络在手写元音上 top-1 分类准确率 70%、top-2 分类准确率 92%。

关键词

引用

@article{arxiv.2006.08367,
  title  = {Tamil Vowel Recognition With Augmented MNIST-like Data Set},
  author = {Muthiah Annamalai},
  journal= {arXiv preprint arXiv:2006.08367},
  year   = {2020}
}

备注

8 pages, 3 figures, 4 tables