中文

STAIR Captions:构建大规模日语图像描述数据集

计算与语言 2017-05-03 v1 计算机视觉与模式识别

摘要

近年来,图像描述(字幕)的自动生成,即图像描述生成,引起了广泛关注。本文特别考虑为图像生成日语描述。由于现有大多数描述数据集都是为英语构建的,日语数据集很少。为解决这个问题,我们基于 MS-COCO 的图像构建了一个大规模日语图像描述数据集,称为 STAIR Captions。STAIR Captions 包含 164,062 张图像的 820,310 条日语描述。在实验中,我们表明,与使用英语-日语机器翻译在生成英语描述后再翻译相比,使用 STAIR Captions 训练的神经网络能生成更自然、更好的日语描述。

关键词

引用

@article{arxiv.1705.00823,
  title  = {STAIR Captions: Constructing a Large-Scale Japanese Image Caption Dataset},
  author = {Yuya Yoshikawa and Yutaro Shigeto and Akikazu Takeuchi},
  journal= {arXiv preprint arXiv:1705.00823},
  year   = {2017}
}

备注

Accepted as ACL2017 short paper. 5 pages