中文

UIT-ViIC:首个越南语图像描述评测数据集

计算与语言 2020-02-04 v1

摘要

图像描述,即自动生成图像标题的任务,近年来吸引了计算机科学许多领域(如计算机视觉、自然语言处理和机器学习)研究人员的关注。本文在图像描述任务上的贡献在于将数据集扩展到另一种语言——越南语。迄今为止,尚无现成的越南语图像描述数据集,因此这是开发越南语图像描述的基础性第一步。在此范围内,我们首先构建了一个数据集,其中包含对来自 Microsoft COCO 数据集中与球类运动相关图像的手动撰写标题,我们将该数据集称为 UIT-ViIC。UIT-ViIC 包含 3,850 张图像的 19,250 条越南语标题。随后,我们在深度神经网络模型上评测我们的数据集,并与英语数据集和两种以不同方法构建的越南语数据集进行比较。UIT-ViIC 已发布于我们实验室网站以供研究使用。

关键词

引用

@article{arxiv.2002.00175,
  title  = {UIT-ViIC: A Dataset for the First Evaluation on Vietnamese Image Captioning},
  author = {Quan Hoang Lam and Quang Duy Le and Kiet Van Nguyen and Ngan Luu-Thuy Nguyen},
  journal= {arXiv preprint arXiv:2002.00175},
  year   = {2020}
}

备注

Submitted to the 2020 ICCCI Conference (The 12th International Conference on Computational Collective Intelligence)